seojuice

Hoe Google-indexering werkt (en hoe je controleert of een pagina is geïndexeerd)

Vadim Kravcenko
Vadim Kravcenko
· Updated · 9 min read

TL;DR: Indexeren betekent dat Google een pagina heeft geanalyseerd en opgeslagen in zijn index, waardoor de pagina in aanmerking komt om in zoekresultaten te verschijnen. Het betekent niet dat de pagina ook goed scoort. Controleer een specifieke URL met de URL-inspectietool van Google Search Console, identificeer de gerapporteerde uitsluiting of canonieke status en los de oorzaak daarvan op—niet door herhaaldelijk “Indexering aanvragen” te klikken.

Status Wat Google heeft gedaan Kan de pagina in de zoekresultaten verschijnen?
Gevonden Google weet dat de URL bestaat, maar heeft die nog niet opgehaald. Nee
Gecrawld Google heeft de pagina gedownload, maar heeft die niet opgeslagen in de index. Nee
Geïndexeerd Google heeft de pagina verwerkt en opgeslagen. Het is in aanmerking, maar moet nog wel ranken voor een zoekopdracht.
Geraankt of getoond Google heeft de geïndexeerde pagina geselecteerd voor een specifieke zoekopdracht. Ja, voor die zoekopdracht.
De vier fasen van Google-indexering: crawl, renderen, indexeren en weergeven.

Wat betekent indexering?

Indexering is de fase waarin Google een webpagina analyseert en informatie ervan opslaat in de Google-index. Zie de index als een bibliotheekcatalogus voor webpagina’s. Als je pagina ontbreekt in die catalogus, kan Google die niet selecteren als een normaal zoekresultaat.

Een geïndexeerde pagina is dus in aanmerking om in Google te verschijnen. Het is geen garantie, en het is zeker geen garantie dat je op pagina één belandt.

Dit onderscheid voorkomt een verrassend hoop verspild werk. Een oprichter zoekt op een net gepubliceerde blogpost, kan die niet vinden en concludeert dat Google die niet heeft geïndexeerd. De pagina kan prima geïndexeerd zijn, maar te laag ranken voor precies die zoekopdracht. Je robots.txt aanpassen lost zo’n rankingprobleem niet op (en kan zelfs een indexeringsprobleem veroorzaken als je het slordig aanpakt).

Google’s documentatie over hoe Search werkt splitst het proces op in crawling, indexering en serving. Ook maakt Google de oncomfortabele beperking expliciet:

“Google garandeert niet dat het je pagina zal crawlen, indexeren of tonen, zelfs als je pagina voldoet aan de Google Search Essentials.”

Dat is de kernregel. Een geldige sitemap, een schone technische opzet en een succesvolle live test maken een pagina toegankelijk voor Google; ze creëren geen “recht” om te indexeren. Google beslist nog altijd of de pagina een plek verdient in de index en of die pagina moet verschijnen bij een zoekopdracht.

De drie poorten tussen publiceren en ranken

1. Crawling: Google haalt de pagina op

Googlebot ontdekt nieuwe en gewijzigde URL’s door bekende pagina’s opnieuw te bezoeken, links te volgen en sitemaps te lezen. Daarna downloadt het resources zoals tekst, afbeeldingen en video.

Google rendert pagina’s ook en draait JavaScript met een recente versie van Chrome. Content die afhankelijk is van JavaScript is niet automatisch onzichtbaar, maar renderen voegt wel een extra verwerkingsstap toe. Serverfouten, netwerkproblemen en robots.txt-beperkingen kunnen verhinderen dat Google ophaalt wat een browser normaal lijkt te tonen.

Een URL kan worden gevonden zonder dat hij wordt gecrawld. Google kan die URL kennen via een sitemap of een interne link, terwijl de pagina zelf nog niet is gedownload. Search Console kan die status rapporteren als Gevonden, momenteel niet geïndexeerd.

2. Indexering: Google verwerkt en slaat de pagina op

Na crawling analyseert Google de tekst van de pagina, het title-element, de alt-attributen van afbeeldingen, afbeeldingen en video. Het kan ook signalen herkennen zoals taal en bruikbaarheid.

Hier wordt duplicate handling belangrijk. Google groepeert vergelijkbare pagina’s en kiest een canonieke versie: de representatieve URL die het geschikt vindt om in de resultaten te verschijnen. Je opgegeven canonical is een signaal, geen bevel. Search Console kan laten zien dat Google een andere URL heeft gekozen als je redirects, interne links, sitemap of content conflicterende signalen geven.

Indexering is daarom meer dan alleen HTML downloaden. De praktische vraag is of Google deze URL heeft opgeslagen, het heeft geconsolideerd naar een andere URL, of heeft besloten om hem niet te indexeren. Er is weinig zin om te praten over “Google begrijpt de pagina” zolang je niet weet welke van die drie dingen is gebeurd.

Google stelt dat “Indexering niet gegarandeerd is; niet elke pagina die Google verwerkt wordt geïndexeerd.” In de documentatie worden lage contentkwaliteit, noindex-instructies en siteontwerpen die verwerking moeilijk maken als mogelijke redenen genoemd.

3. Serving: Google kiest een resultaat voor een zoekopdracht

Wanneer iemand zoekt, selecteert Google resultaten uit de index. Relevantie, locatie, taal en device behoren tot de factoren die kunnen beïnvloeden wat er wordt getoond.

Indexering zet een pagina in de kandidatenset. Ranken bepaalt of die pagina de andere kandidaten verslaat voor een echte zoekopdracht. Ahrefs vond dat 96,55% van de pagina’s in hun ongeveer 14 miljard pagina’s tellende studie geen verkeer van Google kreeg. Dat is een trafficstatistiek, geen indexeringsstatistiek, maar het illustreert de kloof: geïndexeerd zijn is de ondergrens, niet het eindresultaat.

Ik heb dit zelf ook verkeerd gediagnosticeerd door ontbrekende zichtbaarheid te zien als mislukte indexering, omdat de pagina niet opdook voor de zoekopdracht die ik toevallig uitvoerde. De correctie is een stuk minder spannend. Check eerst de URL. Leid de indexstatus niet af uit één keyword.

Hoe je checkt of een pagina geïndexeerd is

Gebruik URL-inspectie voor het betrouwbare antwoord

Open Google Search Console, kies de juiste property en plak de volledige URL in het veld URL-inspectie. Controleer precies het protocol, de hostname, het pad en de versie met of zonder afsluitende slash die je wilt dat Google indexeert.

Die precisie was geen academisch detail tijdens SEOJuice’ migratie van seojuice.io naar seojuice.com in januari 2026. De URL op het oude domein en die op het nieuwe domein waren aparte records, elk met eigen crawl- en canonical-informatie. “Ruwweg de juiste pagina” inspecteren is tijdens een migratie niet genoeg (ik betrapte mezelf erop dat ik dat meer dan eens deed).

Google’s documentatie over URL-inspectie zegt dat de tool informatie rechtstreeks uit de Google-index rapporteert. De belangrijkste uitkomsten zijn:

  • URL staat op Google: de URL is geïndexeerd.
  • URL staat niet op Google: de URL is niet geïndexeerd.
  • URL staat op Google, maar heeft problemen: de URL is geïndexeerd, maar Google heeft waarschuwingen geïdentificeerd.

Vouw de details uit in plaats van te stoppen bij de headline. Check de laatste crawl, crawl-toestemming, indexeringstoestemming, canonical zoals opgegeven door de gebruiker en de canonical die Google zelf heeft geselecteerd. Als Google een andere canonical koos, kan de geïnspecteerde URL niet verschijnen, terwijl de content onder een ander adres wél wordt weergegeven.

Twee kanttekeningen zijn belangrijk. Ten eerste weerspiegelt het rapport de laatst geïndexeerde versie, niet noodzakelijk de pagina die op dit moment live staat op je server. Ten tweede garandeert “URL staat op Google” niet dat hij bij een specifieke zoekopdracht verschijnt, omdat URL-inspectie niet elke “serving”-voorwaarde beoordeelt.

Test Live URL voert een verse fetch door met een Googlebot. Het kan je vertellen of Google nu toegang heeft tot de huidige pagina, maar Google zegt dat de test de index niet bijwerkt. Een test die slaagt betekent dus: crawlbaar nu, niet geïndexeerd nu. Klein verschil. Groot debug-gevolg.

Gebruik site: als snelle check, niet als index-audit

Je kunt Google zoeken op site:example.com/page-url. Als de URL verschijnt, is dat een nuttig initieel signaal. Als hij niet verschijnt, concludeer dan niet meteen dat de pagina is uitgesloten.

Google zegt dat de site:-operator “niet noodzakelijk alle URL’s teruggeeft die onder de in de query gespecificeerde prefix geïndexeerd zijn.” Hun eigen advies is om URL-inspectie te gebruiken wanneer een specifieke URL ontbreekt.

Ik gebruik site: nog steeds, omdat het vijf seconden kost (soms is een check van vijf seconden alles wat ik nodig heb). Ik zou het niet gebruiken voor een migratie-audit, een client-indexatierapport of een beslissing om content te verwijderen.

Hoe je de twee verwarrende statussen “momenteel niet geïndexeerd” interpreteert

Gevonden, momenteel niet geïndexeerd

Dit betekent dat Google de URL heeft gevonden, maar nog niet gecrawld. Google’s documentatie over pagina-indexering zegt dat het doorgaans wilde crawlen, maar verwachtte dat dat de site zou kunnen overbelasten, waardoor de crawl is heringepland.

Het sleutelwoord is gevonden. Google kent het adres—misschien via een sitemap of een link—maar heeft de huidige pagina nog niet gedownload. Het herschrijven van het artikel kan uiteindelijk helpen voor de waarde, maar het lost de onmiddellijke fetch-fase niet op, omdat Google die wijziging nog niet heeft gezien.

Begin met het checken van interne ontdekking, opname in sitemaps, serverbetrouwbaarheid en verspilling door inefficiënte URL-patronen. Op basis van wat Lida en ik zien bij kleinere sites die SEOJuice draaien, is zwakke interne ontdekking een veel productiever eerste onderzoek dan de crawl-budgettheorie: er bestaat een weeskind-artikel in een sitemap, maar geen relevante pagina behandelt het als belangrijk genoeg om ernaar te linken. Dat is een waargenomen patroon, geen universele diagnose.

Gebruik niet standaard “crawl budget” bij een site met een paar honderd pagina’s. Google zegt dat actieve crawl-budgetmanagement vooral relevant is voor zeer grote sites, waaronder sites met ongeveer één miljoen of meer unieke pagina’s of meer dan 10.000 pagina’s die dagelijks wijzigen. Onze gids over crawl budget optimaliseren legt uit wanneer die diagnose wél opgaat en wanneer het juist afleidt.

Gecrawld, momenteel niet geïndexeerd

Deze status betekent dat Google de pagina heeft opgehaald, maar niet heeft geïndexeerd. Google zegt dat de pagina later al dan niet alsnog geïndexeerd kan worden en dat er geen noodzaak is om die nogmaals in te dienen voor crawling.

Toegang werkte. Google ontving de pagina. De volgende inspectie moet zich richten op de onderscheidende waarde, duplicatie, canonical-selectie en hoe de pagina in de rest van de site past.

John Mueller, Google Search Advocate, heeft direct gekoppeld hoe goed een site is aan hoeveel Google indexeert. Zoals gerapporteerd door Search Engine Journal zei Mueller: “Als onze systemen zich serieus zorgen maken over de kwaliteit van de website, verlagen ze het aantal pagina’s in de index.” Bij het bespreken van de twee statussen “momenteel niet geïndexeerd” voegde hij daaraan toe dat Google’s systemen in feite zeggen dat ze de URL kennen en dat, “als we tevreden zijn, we nog eens opnieuw zullen kijken.”

Dit betekent niet dat elke uitgesloten pagina een geheime kwaliteits-score van nul kreeg. Search Console biedt niet dat niveau van diagnose (ik wou dat het wel zo was). Het betekent dat technische toegankelijkheid alleen mogelijk niet genoeg is om een patroon van dunne, repetitieve of zwak gekoppelde pagina’s op te lossen.

Gevonden betekent nog niet opgehaald. Gecrawld betekent opgehaald maar (voor nu) niet opgeslagen. “Momenteel” telt: geen van beide statussen is per definitie permanent.

Waarom een pagina niet geïndexeerd is, en wat je moet aanpassen

Oorzaak of status Wat er gebeurt Eerste actie
Uitgesloten door noindex Google heeft een robots meta-directive of X-Robots-Tag gevonden die aangeeft dat de pagina niet geïndexeerd mag worden. Verwijder de directive als die per ongeluk is; test de live URL en vraag vervolgens indexering aan.
Geblokkeerd door robots.txt Google mag het pad niet crawlen. Sta het pad toe als Google het moet ophalen.
Alternatieve of duplicaat-URL Een andere URL wordt als canoniek behandeld. Check canonicals, redirects, interne links, sitemaps en duplicatie van content.
Gecrawld, momenteel niet geïndexeerd Google heeft de pagina opgehaald maar niet opgeslagen. Verbeter de onderscheidende waarde, consolideer overlap en voeg relevante interne links toe.
Gevonden, momenteel niet geïndexeerd Google kent de URL, maar heeft die niet opgehaald. Verbeter ontdekking, bevestig opname in de sitemap en check crawl-toegankelijkheid.
Soft 404 De URL geeft een succesvolle response terug, maar lijkt op een response van een ontbrekende pagina. Geef een echte 404 of 410 terug, of voeg inhoud van substantiële waarde toe.
Nieuwe URL Google heeft de pagina mogelijk nog niet gecrawld. Link ernaar, dien hem in bij een sitemap, vraag één keer indexering aan en wacht.

Verwar robots.txt niet met noindex

robots.txt stuurt crawling. Een noindex-directive stuurt indexering. Ze hangen samen, maar zijn niet uitwisselbaar.

Als robots.txt voorkomt dat Google een pagina ophaalt, ziet Google mogelijk geen noindex-directive in die pagina. Google legt ook uit dat een geblokkeerde URL alsnog geïndexeerd kan worden zonder de content, zolang die URL via links wordt ontdekt. Als een pagina buiten de index moet blijven, gebruik dan Google’s gedocumenteerde noindex-methode terwijl je Google wel toestaat om te crawlen en de directive te lezen.

SEOJuice heeft een robots.txt-generator om de syntax te maken. Bekijk elke regel tegen de paden die je echt wilt laten crawlen; één te brede disallow kan invloed hebben op duizenden pagina’s (die berekening wordt snel onprettig).

Canonical- en redirectproblemen

“Alternatieve pagina met een juiste canonical-tag” is vaak een verwachte uitsluiting, geen fout. Als print-, gefilterde-, tracking-parameter-, HTTP- en HTTPS-varianten allemaal naar één gewenste URL leiden, hoef je niet elke variant geïndexeerd te krijgen. Een lager aantal uitsluitingen betekent niet automatisch dat de site gezonder is.

Als de uitgesloten URL canoniek zou moeten zijn, maak dan de signalen consistent. Gebruik een passende self-referencing canonical, richt interne links en sitemapvermeldingen op de gewenste URL en zorg dat de pagina inhoudelijk echt anders is. Als een oude URL permanent is vervangen, redirect die dan in plaats van concurrerende varianten te behouden. Onze gids over 301 vs 302 redirects behandelt de keuze voor redirects.

Weespagina’s en zwakke interne ontdekking

Google ontdekt URL’s via links, maar ook via sitemaps. Een sitemap zegt dat een URL bestaat; contextuele interne links laten ook zien hoe die URL zich verhoudt tot de rest van de site en geven Google een extra route om die te bereiken.

Voeg links toe vanaf relevante pagina’s die al zijn geïndexeerd. Compenseer niet door elke URL in één grote footer te plaatsen. Interne-linkkwantiteit zonder thematische context is meestal alleen rommel. Een doelbewuste structuur is zinvoller, zoals uitgelegd in onze gids over content silos voor SEO.

Bij een kleine site zou ik eerst onderzoeken of pagina’s wezen zijn voordat je kijkt naar servercapaciteit. Elke artikel-URL handmatig openen werkt één keer; het werkt niet als de site blijft groeien. De SEOJuice internal-link finder helpt interne-linkkansen te identificeren en is beschikbaar in het gratis abonnement zonder creditcard. Zachte CTA, maar ook de tool die we hebben gebouwd omdat dit werk pijnlijk repetitief is.

Een praktische diagnostische volgorde voor indexering

  1. Inspecteer de exacte URL. Leg de indexstatus vast, de laatste crawl, de door jou opgegeven canonical en de canonical die Google zelf heeft geselecteerd.
  2. Voer Test Live URL uit. Bevestig dat Googlebot de pagina nu kan ophalen. Houd in gedachten: dit update de index niet.
  3. Check indexeerbaarheid. Verwijder per ongeluk noindex-directives, sta noodzakelijke crawling toe en verifieer de gewenste canonical.
  4. Check ontdekking. Voeg de URL toe aan een XML-sitemap en link er vanuit relevante, al geïndexeerde pagina’s naartoe.
  5. Check duplicatie en waarde. Als Google de pagina gecrawld heeft maar niet geïndexeerd, vergelijk die dan met je andere URL’s. Consolideer near-duplicates of maak de pagina inhoudelijk aantoonbaar waardevoller.
  6. Vraag één keer indexering aan. Zet de URL in de crawlwachtrij van Google. Herhaald indienen repareert zwakke content, conflicterende canonicals of geblokkeerde crawling niet.
  7. Check opnieuw de status. Diagnoseer wat Search Console als volgende rapporteert, in plaats van elke vertraging als dezelfde mislukking te behandelen.

Leg geen universele deadline van 24 uur op. Search Engine Land meldde de richtlijnen van Google Search Advocate John Mueller dat indexeren van nieuwe of geüpdatete content “van enkele uren tot enkele weken” kan duren. Mueller waarschuwde ook dat forceren van indexering niet betekent dat de pagina prominent wordt getoond in Search.

Ik vertrouw de volgorde hierboven meer dan welke precieze indexeringstimer ook. Sitegeschiedenis, interne ontdekking, technische toegang, duplicatie, contentkwaliteit en Google’s planning verschillen allemaal. Als iemand je een exact gemiddeld belooft zonder een transparante dataset, zou ik voorzichtig zijn (of in elk geval vragen wat hun sample bevatte).

Veelgestelde vragen

Wat betekent “geïndexeerd” op Google?

Geïndexeerd betekent dat Google een pagina heeft verwerkt en opgeslagen in de Google-index, waardoor hij in aanmerking komt om in zoekresultaten te verschijnen. Het betekent niet dat de pagina rankt voor een specifiek keyword. Serving is de latere fase waarin Google geïndexeerde pagina’s voor een zoekopdracht selecteert.

Hoe lang duurt het voordat Google een nieuwe pagina indexeert?

John Mueller zei dat indexeren van nieuwe of geüpdatete content van enkele uren tot enkele weken kan duren. Er is geen gegarandeerde planning. Een sitemap, nuttige interne links en URL-inspectie kunnen ontdekking verbeteren of de URL in de crawlwachtrij zetten, maar niets dwingt Google om te indexeren.

Waarom staat mijn pagina op “Gecrawld, momenteel niet geïndexeerd”?

Google heeft de pagina gedownload maar niet opgeslagen in de index. Controleer of de content onderscheidend en bruikbaar is, of Google een andere canonical heeft gekozen en of relevante interne pagina’s naar de pagina linken. Google zegt dat de URL later alsnog geïndexeerd kan worden en dat hij niet herhaaldelijk opnieuw hoeft te worden ingediend voor crawling.

Hoe krijg ik Google sneller om mijn pagina te indexeren?

Dien een XML-sitemap in, voeg relevante interne links toe vanuit bekende pagina’s, controleer of de URL crawlbaar en indexeerbaar is en gebruik de optie “Indexering aanvragen” van URL-inspectie één keer. Deze stappen verbeteren ontdekking en toegankelijkheid, maar Google belooft geen indexeringstermijn.

Wat is het verschil tussen crawlen en indexeren?

Crawlen betekent dat Googlebot de pagina heeft gedownload. Indexeren betekent dat Google de pagina verwerkt en opslaat, zodat hij een zoekresultaat kan worden. Een gecrawlde pagina wordt niet automatisch geïndexeerd en een geïndexeerde pagina wordt niet automatisch gerankt.

Voorkomt robots.txt dat een pagina geïndexeerd wordt?

Niet betrouwbaar. robots.txt blokkeert crawling, niet indexering. Soms kan Google een geblokkeerde URL indexeren zonder de content te begrijpen, als links die URL onthullen. Om een crawlbare pagina buiten de Google-index te houden, gebruik je een noindex-directive waarmee Googlebot de directive mag ophalen en lezen.

SEOJuice
Stay visible everywhere
Get discovered across Google and AI platforms with research-based optimizations.
Works with any CMS
Automated Internal Links
On-Page SEO Optimizations
Get Started Free

no credit card required

More articles

No related articles found.