Kennisbank · SEO
Wat is zoekwoorddichtheid?
Zoekwoorddichtheid is hoe vaak een zoekwoord in je tekst voorkomt, gedeeld door het totale aantal woorden, maal honderd. Staat "dakgoot reinigen" acht keer in een tekst van achthonderd woorden, dan is de dichtheid één procent.
Het is een van de bekendste getallen uit de SEO-wereld en tegelijk een van de minst bruikbare. Hieronder staat waar het vandaan komt, waarom het niet meer werkt, en wat je nu in plaats daarvan zou moeten bekijken.
Hoe je het uitrekent, en waarom de uitkomst wankelt
De som is eenvoudig: aantal keer dat het woord voorkomt, gedeeld door het aantal woorden, maal honderd. Het probleem zit in alles wat de som niet vastlegt.
Bestaat je zoekwoord uit twee woorden, dan telt de ene rekenmachine dat als één voorkomen en de andere als twee, wat je uitkomst meteen verdubbelt of halveert. Tellen de woorden in je menu, je zijbalk en je voettekst mee? Op de meeste sites is dat een paar honderd woorden die op elke pagina hetzelfde zijn. Tel je de alt-teksten mee, de knoptekst, de tekst in de cookiemelding?
Reken hetzelfde artikel na met drie verschillende hulpmiddelen en je krijgt drie verschillende percentages. Dat is niet omdat er één goed rekent en twee fout, maar omdat er geen afspraak bestaat over wat je meet. Een getal waarvan de definitie per gereedschap verschilt, kun je nergens mee vergelijken.
In het Nederlands wordt het nog rommeliger
Nederlands plakt woorden aan elkaar. Waar het Engels "gutter cleaning" schrijft, schrijven wij "dakgootreiniging". Zoek je op "dakgoot reinigen" dan komt dat woord in je tekst misschien nul keer voor als losse combinatie, terwijl je pagina nergens anders over gaat.
Daar komen verbuigingen bij: dakgoot, dakgoten, reinigen, gereinigd, reiniging. Een teller die op exacte tekens let, ziet vijf verschillende woorden. Google niet, want die brengt woordvormen terug tot hun stam en herkent samenstellingen. Je rekent dus iets uit dat de zoekmachine allang anders bekijkt.
Waar dat getal ooit vandaan kwam
Zoekwoorddichtheid is een volksversie van iets echts. In het vakgebied dat over zoeken in tekst gaat, bestaat sinds de jaren zeventig het idee van termfrequentie: hoe vaker een woord in een document staat, hoe waarschijnlijker het is dat het document daarover gaat.
Dat werkt alleen niet zonder tegengewicht, want dan zou "de" het belangrijkste woord van elke Nederlandse tekst zijn. Karen Spärck Jones beschreef in 1972 de omgekeerde documentfrequentie: woorden die in bijna elk document voorkomen zeggen weinig, woorden die zeldzaam zijn zeggen veel. De combinatie van die twee heet TF-IDF en zit tot op de dag van vandaag in zoeksystemen.
De eerste zoekmachines op het web leunden er zwaar op, en ze keken vrijwel alleen naar wat er op de pagina zelf stond. Wie zijn pagina volstopte met "goedkope autoverzekering" kwam hoger. Dat werkte precies zolang tot iedereen het doorhad.
Ergens in die jaren is termfrequentie in handleidingen veranderd in een percentage met een streefwaarde. Dat is de vertaalfout waar de hele mythe op rust: TF-IDF vergelijkt jouw pagina met alle andere pagina's, terwijl dichtheid alleen naar je eigen tekst kijkt.
Waarom vaker herhalen niets meer oplevert
Zoeksystemen zijn al in de jaren negentig gestopt met het rechtstreeks meewegen van het aantal keer dat een woord voorkomt. De reden is dat de tweede vermelding van een woord veel meer toevoegt dan de twintigste.
In de weegformules die daarna kwamen, zit daarom verzadiging ingebouwd. Het effect van elke volgende herhaling wordt kleiner, en na een handvol keren is er praktisch geen verschil meer tussen tien en dertig vermeldingen. Daar zit meteen de tweede correctie bij: een langere tekst bevat vanzelf meer voorkomens van elk woord, dus wordt er gecorrigeerd voor lengte.
Die twee ingrepen maken een streefpercentage betekenisloos. Als het verschil tussen acht en achttien vermeldingen door de formule wordt platgedrukt, valt er niets te optimaliseren aan het getal ertussen. En omdat er voor lengte wordt gecorrigeerd, verandert je positie niet doordat je de tekst inkort of uitbreidt.
Wat wel is overgebleven is een bovengrens. Wie zo ver over de streep gaat dat het opvalt, valt onder het spambeleid. Dat is geen dichtheidsregel, dat is een andere afdeling.
Wat Google achtereenvolgens heeft veranderd
De afbouw ging in stappen, en die stappen hebben namen en jaartallen.
De Florida-update van november 2003 was de eerste die zichtbaar afrekende met pagina's die op woordherhaling leunden. Panda kwam in februari 2011 en richtte zich op dunne pagina's die alleen bestonden om een zoekwoord af te vangen. Penguin volgde in april 2012 en pakte openlijke spamtechnieken aan, waaronder volgestopte teksten; sinds 2016 draait dat doorlopend mee in het kernalgoritme.
Daarna verschoof het van straffen naar begrijpen. Hummingbird uit september 2013 keek naar de betekenis van een hele zoekopdracht in plaats van naar losse woorden. RankBrain kwam in 2015 en leerde onbekende zoekopdrachten uitleggen aan de hand van bekende. BERT volgde in 2019, eerst voor het Engels en eind dat jaar ook voor het Nederlands, en dat systeem leest zinsverband: het verschil tussen "reizen naar Nederland vanuit België" en andersom.
In augustus 2022 kwam er een systeem bij dat pagina's beoordeelt op de vraag of ze voor mensen zijn geschreven of voor de zoekmachine. Dat is in maart 2024 opgegaan in het kernalgoritme. Hoe die systemen samenhangen, leg ik uit bij zoekmachinealgoritmen.
De één tot drie procent uit de handleidingen
Vrijwel elk advies over dichtheid noemt een bandbreedte tussen ongeveer één en drie procent. Dat getal is nooit door Google bevestigd en er ligt geen onderzoek onder dat je kunt nalezen. Het is overgeschreven, jarenlang, van blog naar blog.
Waarom het toch blijft rondzingen: je SEO-plugin toont het. Yoast heeft een controle op zoekwoorddichtheid met een gekleurd bolletje en een bandbreedte die ergens tussen een half en drie procent ligt. Andere plugins doen iets vergelijkbaars in een puntentelling.
Die bolletjes zijn het oordeel van de plugin, niet van Google. Yoast zegt er zelf bij dat het om leesbaarheid en natuurlijk taalgebruik gaat, maar in de praktijk gaan mensen het bolletje groen maken, en dat is de verkeerde beweging. Ik heb teksten gezien waar een zin was toegevoegd die niets zei, alleen om het zoekwoord er nog een keer in te krijgen.
Staat je bolletje oranje omdat de dichtheid te laag is, lees de tekst dan gewoon terug. Komt het onderwerp duidelijk over, dan is er niets aan de hand. Wat een zoekwoord is en welke soorten er zijn, lees je bij zoekwoorden in SEO.
Keyword stuffing: wat er wel wordt aangepakt
Google noemt keyword stuffing met zoveel woorden in zijn spambeleid. Het gaat om pagina's volproppen met woorden of getallen, met als voorbeeld lijsten met plaatsnamen of telefoonnummers zonder verdere inhoud.
Je herkent het aan zinnen als: "Zoek je een loodgieter Amersfoort? Onze loodgieter Amersfoort staat voor je klaar, want als loodgieter Amersfoort weten wij." Niemand schrijft zo, en dat is het punt.
In dezelfde categorie valt verstopte tekst: witte letters op een witte achtergrond, een blok woorden achter een afbeelding, tekst met een lettergrootte van nul, of een grijze woordenbrij onderaan de pagina. Dat werkte rond 2005. Nu is het een reden om je uit de resultaten te halen.
Wat er dan gebeurt is dat je pagina's minder goed gaan draaien, of dat je een handmatige maatregel krijgt. Die staat in Search Console onder Handmatige maatregelen, met een omschrijving van wat er mis is. Je haalt de rommel weg en vraagt een heroverweging aan. Zonder handmatige maatregel valt er niets aan te vragen en zak je gewoon weg, wat je aan je bezoekcijfers merkt.
Wat ervoor in de plaats is gekomen
Woorden zijn vervangen door onderwerpen. Google werkt sinds 2012 met een kennisgraaf waarin dingen, personen en bedrijven als eenheden staan met verbanden ertussen. Je pagina wordt gekoppeld aan dat onderwerp, niet aan een tekenreeks.
Daar horen drie dingen bij die je wel kunt beïnvloeden. Ten eerste of je de onderwerpen aanraakt die bij het hoofdonderwerp horen. Schrijf je over dakgoten, dan komen afschot, regenpijp, bladvanger en hemelwaterafvoer vanzelf voorbij. Komen ze niet voorbij, dan ken je het onderwerp niet goed genoeg, en dat is het signaal waar een zoekmachine op let.
Ten tweede of je de vraag afmaakt, inclusief de vervolgvraag die er direct achteraan komt. Sinds 2021 kan Google bovendien een losse alinea uit een lange pagina naar voren halen als antwoord, ook als de rest van die pagina over iets anders gaat. Een goed geschreven tussenkop met een compleet antwoord eronder is daardoor meer waard dan een hoge dichtheid.
Ten derde of de pagina past bij wat iemand zocht. Zoekt iemand een uitleg en krijgt hij een verkooppagina, dan houdt geen enkel percentage hem vast. Waar je je zoekwoord neerzet doet nog wel degelijk iets, maar dan gaat het over plaatsen en niet over aantallen. Dat is een verhaal apart, te vinden bij waar je zoekwoorden op je pagina plaatst.
Dezelfde gedachte onder een nieuwe naam
Sinds een paar jaar zijn er hulpmiddelen die je tekst vergelijken met de pagina's die nu bovenaan staan en je een lijst met woorden geven die je nog mist, plus een score. Ze noemen dat inhoudsanalyse of TF-IDF-analyse.
Als hulpmiddel om te zien wat je bent vergeten is dat prima. Zo'n lijst laat vaak zien dat de bovenste tien pagina's allemaal iets behandelen waar jij niets over zegt, en dat is nuttige informatie.
Als doel op zich is het dezelfde fout in een nieuw jasje. Schrijven om een score van 80 naar 92 te krijgen levert teksten op waarin woorden zijn ingemetseld die er niet horen. Het verschil met ouderwetse dichtheid is dat je nu dertig woorden aan het tellen bent in plaats van één.
Mijn vuistregel: gebruik zo'n lijst als geheugensteun voordat je schrijft, niet als eindexamen erna. En als het gereedschap zegt dat je een woord mist dat in jouw vak niemand gebruikt, dan mist het gereedschap iets en niet jij.
De plek waar herhaling nog wel opvalt
Er is één plaats waar te veel van hetzelfde zoekwoord nog steeds tegen je werkt, en dat is de tekst waarop wordt gelinkt.
Wijzen honderd links van andere sites naar jouw pagina met precies dezelfde ankertekst "goedkope autoverzekering", dan is dat geen toeval. Zo praten mensen niet. Ze linken met je bedrijfsnaam, met je adres, met "hier", met de titel van je artikel. Een profiel dat er te netjes uitziet, ziet er gekocht uit.
Hetzelfde geldt binnen je eigen site, al is dat minder ernstig. Als je vanuit elke pagina met exact dezelfde tekst naar één pagina linkt, is dat vooral saai voor je lezer. Varieer gewoon, zoals je in gewone taal ook zou doen. Meer daarover bij linkbuilding.
Wat je in plaats daarvan bijhoudt
Zet je site in Google Search Console, gratis en met zestien maanden geschiedenis. Daar staat op welke zoekopdrachten je pagina's echt zijn getoond, hoe vaak erop is geklikt en op welke gemiddelde positie je stond.
Het waardevolste dat je daar vindt zijn de zoekopdrachten waarop je al vertoningen krijgt zonder dat je erop hebt geschreven. Dat zijn onderwerpen waar je pagina bijna goed genoeg voor is. Een alinea toevoegen die die vraag echt beantwoordt levert meer op dan welk percentage dan ook.
Kijk daarnaast naar het verschil tussen posities. Sta je op plek elf tot vijftien, dan sta je op pagina twee en krijg je vrijwel geen klikken. Dat zijn de pagina's waar een uur werk het meeste doet. Hoe je die kansen tegen elkaar afweegt, behandel ik bij zoekwoordanalyse. Hoe je aan zo'n lijst met zoekopdrachten komt, bij zoekwoordonderzoek.
Zoek je specifiek naar zoekopdrachten met weinig concurrentie, dan is de kant van de langere en specifiekere vragen interessant. Daarover gaat het stuk over long-tail zoekwoorden.
Een volgestopte tekst opknappen
Heb je nog pagina's uit de tijd dat dit advies gangbaar was, dan herken je ze meteen. De pagina leest houterig, dezelfde woordcombinatie staat in elke alinea, en er staat vaak een blok met plaatsnamen onderaan.
Zo pak ik dat aan. Lees de pagina hardop. Elke zin waar je over struikelt is een zin waar het zoekwoord in geperst is. Vervang het zoekwoord daar door het woord dat je in een gesprek zou gebruiken: dat ding, die dienst, hij, of gewoon niets.
Gooi het blok met plaatsnamen weg. Als je echt in twintig plaatsen werkt, is dat een reden voor twintig pagina's met eigen inhoud, of voor één zin die zegt waar je werkt.
Voeg daarna toe wat er ontbreekt: de vraag die de lezer na de eerste alinea krijgt. Bijna elke volgestopte tekst is ook een dunne tekst, omdat de ruimte naar herhaling ging in plaats van naar antwoorden.
Verwacht geen sprong binnen een week. Google moet de pagina opnieuw ophalen en beoordelen, en bij een site die weinig verandert kan dat weken duren.
Telt dichtheid mee voor AI-antwoorden
Sinds 2024 verschijnt er boven de gewone resultaten steeds vaker een samengesteld antwoord, en veel mensen stellen hun vraag inmiddels rechtstreeks aan een chatassistent. De vraag is dus of herhaling daar nog helpt.
Dat doet het niet, en waarschijnlijk minder dan ergens anders. Zulke systemen werken met betekenisvectoren en niet met tellingen: ze zoeken passages die inhoudelijk op de vraag lijken, ongeacht welke woorden er precies staan.
Wat er wel toe doet is of een stuk tekst op zichzelf te begrijpen is. Een alinea die begint met een compleet antwoord in één zin, onder een kop die de vraag stelt, is bruikbaar zonder de rest van de pagina. Dat is hetzelfde advies dat al jaren geldt voor uitgelichte fragmenten, en het gaat over vorm, niet over frequentie.
Blijf verder gewoon doen wat werkt: duidelijke koppen, korte alinea's, cijfers en jaartallen die kloppen, en zeggen wie je bent. Hoe dat in het grotere geheel past, vind je bij zoekmachineoptimalisatie.
Veelgestelde vragen over zoekwoorddichtheid
Wat is een goede zoekwoorddichtheid?
Die bestaat niet. Er is geen percentage waar je naartoe moet werken, want zoekmachines wegen woordfrequentie met verzadiging en corrigeren voor tekstlengte. De enige grens die er is, is aan de bovenkant: zoveel herhaling dat het opvalt als spam.
Hoe bereken je zoekwoorddichtheid?
Deel het aantal keer dat het zoekwoord voorkomt door het totale aantal woorden en vermenigvuldig met honderd. Bij een zoekwoord van twee woorden moet je zelf kiezen of je dat als één voorkomen telt of als twee, en die keuze bepaalt je uitkomst.
Straft Google een te hoge zoekwoorddichtheid af?
Google straft geen percentage af, maar wel keyword stuffing: een pagina vullen met herhaalde woorden of lijsten getallen die niets toevoegen. Dat staat met zoveel woorden in het spambeleid. Waar de grens ligt is nergens in een getal uitgedrukt, en daarom stuur je op leesbaarheid.
Waarom zegt Yoast dat mijn zoekwoorddichtheid te laag is?
Omdat Yoast een eigen bandbreedte hanteert en jouw tekst daaronder valt. Dat is het oordeel van de plugin en niet van Google. Lees de tekst terug: als het onderwerp duidelijk overkomt, kun je het oranje bolletje laten staan.
Telt een zoekwoord van twee woorden als één of als twee?
Dat verschilt per hulpmiddel, en daar zit een van de zwakke plekken van deze maatstaf. Reken je "dakgoot reinigen" als één term, dan krijg je de helft van het percentage dat je krijgt als je beide woorden apart telt. Beide uitkomsten zijn even zinvol, wat wil zeggen: allebei niet zo.
Tellen de woorden in mijn menu en voettekst mee?
Bij de meeste hulpmiddelen wel, omdat ze de hele pagina inlezen. Dat vertekent flink, want die paar honderd woorden staan op elke pagina hetzelfde. Zoekmachines herkennen terugkerende navigatie en wegen die anders dan je hoofdtekst.
Hoe vaak moet ik mijn zoekwoord noemen?
Zo vaak als het in normale zinnen langskomt. In de praktijk komt dat neer op de titel, de eerste alinea, minstens één tussenkop en verder waar het vanzelf past. Tellen is niet nodig; hardop lezen wel.
Moet mijn zoekwoord in elke tussenkop staan?
Nee, en het valt onaangenaam op als je het doet. Een tussenkop hoort te zeggen wat er in die sectie staat, zodat een lezer kan scannen. Als het zoekwoord daar natuurlijk in past, prima, en anders schrijf je gewoon een goede kop.
Wat als mijn zoekwoord helemaal niet in de tekst voorkomt?
Dan mist er waarschijnlijk iets, al is het maar voor de lezer die wil zien dat hij goed zit. Google begrijpt synoniemen en woordvormen, dus je hoeft niet de exacte combinatie te gebruiken. Komt het onderwerp nergens letterlijk terug, dan is de pagina meestal ook voor mensen vaag.
Is TF-IDF beter dan zoekwoorddichtheid?
Als idee wel, want TF-IDF vergelijkt jouw tekst met een verzameling andere teksten en corrigeert voor woorden die overal voorkomen. Als werkwijze voor een ondernemer is het net zo'n valkuil: je gaat woorden inpassen om een score te halen, en dat leest niemand graag.
Werkt zoekwoorddichtheid nog bij Bing?
Ook daar niet als streefpercentage. Bing beschrijft in zijn richtlijnen dezelfde lijn: schrijf voor mensen, vermijd overmatige herhaling. De onderliggende technieken verschillen in details, maar niet in dit punt.
Hoeveel woorden moet een tekst hebben om te scoren?
Er is geen minimum. Google heeft meerdere keren gezegd dat het aantal woorden geen rangschikkingsfactor is. Langere teksten scoren vaak beter omdat ze meer vragen beantwoorden, niet omdat ze langer zijn. Een pagina die in driehonderd woorden af is, moet driehonderd woorden blijven.
Telt zoekwoorddichtheid mee voor AI-antwoorden?
Nee. Systemen die antwoorden samenstellen werken met betekenis en niet met tellingen. Wat daar wel helpt is een alinea die op zichzelf te begrijpen is, met het antwoord in de eerste zin en een kop erboven die de vraag stelt.
Wat doe ik met oude pagina's die volgestopt zijn met zoekwoorden?
Herschrijven, te beginnen bij de zinnen waar je over struikelt als je hardop leest. Haal het blok met plaatsnamen onderaan weg en gebruik de vrijgekomen ruimte om de vervolgvraag van de lezer te beantwoorden. Reken op weken voordat je er iets van terugziet in de resultaten.
Dit artikel hoort bij SEO. Daar vind je meer uitleg over hetzelfde onderwerp.
