Begrip
Crawler (webcrawler)
Een crawler doorzoekt websites voor zoekmachines en AI. Ontdek hoe crawlen werkt, het verschil met indexeren, en hoe je crawlers aanstuurt.
SEO-, GEO- en AI-specialist · Bijgewerkt: 10 juli 2026 · Leestijd: 5 min
Wat is een crawler (webcrawler)?
Een crawler, ook wel webcrawler, bot of spider genoemd, is een geautomatiseerd programma dat websites bezoekt, de inhoud uitleest, en links naar andere pagina's volgt om steeds nieuwe content te ontdekken. Zoekmachines gebruiken crawlers om het web in kaart te brengen en pagina's te kunnen tonen in de zoekresultaten.
Kernpunten
- Een crawler (ook wel webcrawler, bot of spider) is een geautomatiseerd programma dat websites bezoekt, de inhoud uitleest en links volgt om nieuwe content te ontdekken.
- Een crawler start bij bekende URL's, volgt elke link naar nog onbekende pagina's en stuurt wat hij aantreft terug naar de index van de zoekmachine.
- De bekendste crawlers zijn Googlebot, Bingbot en AI-crawlers zoals GPTBot (OpenAI) en ClaudeBot (Anthropic).
- AI-crawlers vallen in drie typen uiteen: trainingsbots, zoekindexbots en live-fetch-bots. Alleen de laatste twee bepalen of je citeerbaar bent in AI-antwoorden.
- Crawlen is niet hetzelfde als indexeren: een pagina kan gecrawld worden zonder ooit in de zoekresultaten te verschijnen.
- Met robots.txt, een sitemap en een goede interne linkstructuur stuur je aan wat crawlers op je site wel en niet bezoeken.
De World Wide Web Wanderer wordt algemeen gezien als de eerste webcrawler, gebouwd in juni 1993 door Matthew Gray aan het MIT om de grootte van het toen nog piepkleine web te meten. Het concept crawler bestaat dus al vrijwel net zo lang als het web zelf.
Hoe werkt een crawler?
Een crawler start bij een lijst bekende URL's, haalt de pagina op, leest de inhoud en de HTML-structuur uit, en volgt vervolgens elke link op die pagina naar een volgende, nog onbekende pagina. Dit proces herhaalt zich continu: elke nieuw gevonden link levert weer nieuwe pagina's op om te bezoeken.
Wat een crawler daarbij aantreft, stuurt hij terug naar de zoekmachine, die de gegevens verwerkt en opslaat in een index (een enorme database van bekende pagina's). Pas na deze stap kan een pagina in de zoekresultaten verschijnen. Publiceer je een nieuwe pagina zonder dat er ergens naartoe gelinkt wordt, dan kan het weken duren voordat een crawler die toevallig tegenkomt, of hij vindt hem nooit.
Welke crawlers ken je?
De bekendste crawlers zijn:
- Googlebot: de crawler van Google, met aparte varianten voor desktop en mobiel.
- Bingbot: de crawler van Microsoft's zoekmachine Bing.
- AI-crawlers: zoals GPTBot (OpenAI), ClaudeBot (Anthropic) en Google-Extended, die content ophalen voor het trainen van AI-modellen of voor realtime AI-antwoorden.
- SEO-tool-crawlers: zoals AhrefsBot en SemrushBot, die websites scannen voor SEO-analysetools.
Elke crawler identificeert zich met een eigen user-agent (een herkenbare naam waarmee hij zich bekendmaakt aan een website).
Wat zijn AI-crawlers?
AI-crawlers zijn crawlers van AI-bedrijven zoals OpenAI, Anthropic, Google en Perplexity. Ze vallen grofweg in drie typen uiteen: trainingsbots (verzamelen tekst om AI-modellen te trainen), zoekindexbots (bouwen de index waaruit een AI-assistent live citeert) en live-fetch-bots (halen een pagina op op het moment van de vraag). Dat onderscheid is belangrijk, want het bepaalt wat het blokkeren van zo'n bot je kost: een trainingsbot blokkeren raakt je AI-zichtbaarheid niet, een zoekindexbot of live-fetch-bot blokkeren wel.
| AI-crawler | Bedrijf | Type | Effect als je hem blokkeert |
|---|---|---|---|
| GPTBot | OpenAI | Trainingsbot | Geen trainingsdata meer voor GPT-modellen; geen effect op je zichtbaarheid in ChatGPT. |
| OAI-SearchBot | OpenAI | Zoekindexbot | Niet meer citeerbaar in ChatGPT-zoekantwoorden. |
| ChatGPT-User | OpenAI | Live-fetch-bot | ChatGPT kan je pagina niet openen als een gebruiker ernaar vraagt. |
| ClaudeBot | Anthropic | Trainingsbot | Geen trainingsdata meer voor Claude-modellen; zichtbaarheid blijft. |
| Claude-SearchBot | Anthropic | Zoekindexbot | Niet meer citeerbaar in Claude-zoekantwoorden. |
| PerplexityBot | Perplexity | Zoekindexbot | Niet meer citeerbaar in AI-zoekmachine Perplexity. |
| Google-Extended | Trainingsschakelaar | Geen eigen crawler maar een robots.txt-regel; blokkeren stopt Gemini-training, maar haalt je niet uit AI Overviews (het crawlen zelf doet Googlebot). | |
| CCBot | Common Crawl | Trainingsbot | Je content verdwijnt uit het open webarchief dat veel AI-bedrijven als trainingsdata gebruiken. |
| Bytespider | ByteDance | Trainingsbot | Beperkt effect: deze bot staat erom bekend robots.txt niet altijd te respecteren. |
Wil je citeerbaar blijven in AI-antwoorden, laat dan in elk geval de zoekindexbots en live-fetch-bots toe. Met onze gratis AI-robots checker zie je in een paar seconden welke AI-crawlers jouw robots.txt nu toelaat of blokkeert.
Wat is het verschil tussen crawlen en indexeren?
Crawlen is het bezoeken en uitlezen van een pagina. Indexeren is de stap daarna: het daadwerkelijk opslaan van die pagina in de doorzoekbare database van de zoekmachine. Een pagina kan gecrawld worden zonder ooit geïndexeerd te raken, bijvoorbeeld als de content te dun is, als er een duplicate-content-probleem speelt, of als een noindex-instructie dat expliciet verbiedt. Andersom kan een pagina soms zelfs zonder volledige crawl toch als URL in de resultaten verschijnen, wanneer andere sites ernaar linken.
Hoe stuur je crawlers aan op je website?
Met een robots.txt-bestand geef je crawlers instructies over welke delen van je site ze wel en niet mogen bezoeken. Een sitemap helpt crawlers juist om je belangrijkste pagina's sneller te vinden. Ook je interne linkstructuur speelt mee: pagina's zonder enige interne link zijn voor een crawler lastig te ontdekken.
Wil je weten hoe crawlers, inclusief AI-crawlers, met jouw website omgaan? Bekijk ons eigen onderzoek naar crawlergedrag bij Nederlandse sites.

Gratis vindbaarheidscheck
Weet jij hoe zichtbaar je bent in Google en AI?
In 30 minuten check ik je huidige vindbaarheid in Google, ChatGPT en Claude. Je krijgt direct inzicht in waar je nu staat, waar de kansen liggen en wat als eerste impact maakt. Geen verplichtingen.
- Gesprek van 30 minuten, vrijblijvend
- Check van je vindbaarheid in Google en AI
- De drie kansen met de meeste impact
- Eerlijk advies of mijn aanpak bij je past
Veelgestelde vragen over crawler (webcrawler)
Wat is het verschil tussen een gewone crawler en een AI-crawler?
Een gewone zoekmachine-crawler zoals Googlebot haalt content op om die in de klassieke zoekresultaten te tonen. Een AI-crawler haalt content op om een AI-model te trainen, of om in realtime een AI-antwoord samen te stellen. Beide typen respecteren doorgaans dezelfde robots.txt-regels, maar niet elke AI-crawler doet dat consequent.
Waarom zou je een crawler willen blokkeren?
Redenen lopen uiteen van het sparen van crawlbudget (serverbelasting door onbelangrijke pagina's) tot bewuste keuzes rond auteursrecht en AI-training. Blokkeer je een crawler die ook je zoekzichtbaarheid bepaalt, zoals Googlebot, dan verdwijn je in de praktijk uit de zoekresultaten, dus wees selectief in wat je blokkeert.
Wat is crawlbudget?
Crawlbudget is het aantal pagina's dat een crawler binnen een bepaalde periode van jouw site bezoekt. Bij kleinere sites is dit zelden een probleem, maar bij grote sites met duizenden pagina's kan een crawler zijn tijd verspillen aan onbelangrijke pagina's, waardoor belangrijke content minder vaak opnieuw wordt bezocht.
Hoe weet ik welke crawlers mijn website bezoeken?
Je kunt crawlerbezoeken terugvinden in je serverlogs, of via tools zoals Google Search Console (voor Googlebot specifiek) of gespecialiseerde AI-crawler-dashboards die bijhouden welke bots, waaronder AI-crawlers, je site aftasten en hoe vaak. Sommige hostingpakketten en CDN's tonen deze gegevens ook standaard in een dashboard, zonder dat je zelf logbestanden hoeft uit te pluizen.

Geschreven door
Matt TimmermansSEO-, GEO- en AI-specialist
Matt Timmermans is oprichter van Timmermans Media en gespecialiseerd in SEO, GEO en AI-zichtbaarheid. Sinds 2018 helpt hij bedrijven beter gevonden te worden door zowel Google als AI-zoekmachines. Als AI-expert heeft hij ruime ervaring met AI-automatisering en het bouwen van applicaties met AI.
Wil je meer weten?
Gerelateerde begrippen
robots.txt
Robots.txt vertelt crawlers welke delen van je site ze mogen bezoeken. Ontdek de werking, de grootste mythe, en hoe je AI-crawlers blokkeert.
Lees uitleg→Indexeren
Indexeren is het opnemen van een pagina in de zoekindex. Ontdek het verschil met crawlen en ranken, en waarom robots.txt indexeren niet voorkomt.
Lees uitleg→Interne link
Een interne link verbindt twee pagina's op je website. Ontdek de drie functies, het verschil met backlinks, en hoe je ze slim inzet.
Lees uitleg→