Kennisbank · Begrip
AI-crawlers: wie je content ophaalt en waarom
Bots van AI-aanbieders zoals GPTBot, OAI-SearchBot, ClaudeBot en PerplexityBot die pagina's ophalen voor training, een zoekindex of live antwoorden. Zonder crawl geen citatie.
Door Amanda, Content Strategist & GEO Editor · Laatst bijgewerkt:
Belangrijkste punten
- AI-crawlers halen content op voor training én voor live antwoorden met bronvermelding.
- Blokkeer je alles, dan verdwijn je uit AI-antwoorden en verlies je citaties.
- Onderscheid trainingsbots van zoek- en antwoordbots in je robots.txt.
- Vrijwel geen AI-crawler voert JavaScript uit: server-side HTML is verplicht.
- Meet hun gedrag in je serverlogs, niet in Search Console.
Wat AI-crawlers zijn
AI-crawlers zijn geautomatiseerde bots van AI-aanbieders die webpagina's ophalen. Ze vallen grofweg in drie groepen: bots die data verzamelen voor modeltraining, bots die tijdens een gesprek live pagina's ophalen om een vraag te beantwoorden, en bots die een eigen zoekindex bouwen. Die groepen vragen om verschillend beleid.
De belangrijkste bots
OpenAI gebruikt GPTBot voor training, OAI-SearchBot voor de zoekindex en ChatGPT-User voor live ophalen tijdens een gesprek. Anthropic gebruikt ClaudeBot en Claude-User. Google onderscheidt Googlebot van Google-Extended, waarmee je Gemini-training kunt uitsluiten zonder je Google-ranking te raken. Verder zie je PerplexityBot, Applebot-Extended, Bytespider, CCBot van Common Crawl en Meta-ExternalAgent.
Blokkeren of toelaten?
Voor de meeste bedrijven die zichtbaarheid willen, is toelaten de juiste keuze: geen crawl betekent geen citatie. Publishers met betaalde content of een licentiemodel kiezen vaker voor blokkeren van trainingsbots, maar laten de antwoordbots wel toe zodat ze in AI-antwoorden zichtbaar blijven met bronvermelding. Maak de keuze bewust per botgroep, niet met één blinde blokkade.
Zo stuur je het aan in robots.txt
Zet per user-agent een blok met Allow- of Disallow-regels. Wil je training uitsluiten maar antwoorden toestaan, dan blokkeer je GPTBot, Google-Extended en CCBot en laat je OAI-SearchBot, ChatGPT-User, ClaudeBot en PerplexityBot toe. Robots.txt is een beleefdheidsafspraak: nette aanbieders houden zich eraan, scrapers niet. Voor harde blokkades gebruik je firewall- of CDN-regels.
Wat je content crawlbaar maakt
Lever volledige HTML server-side, want vrijwel geen AI-crawler rendert JavaScript. Houd je responstijd laag en vermijd agressieve rate limiting of bot-challenges die AI-bots per ongeluk buitensluiten — een veelvoorkomende oorzaak van onzichtbaarheid. Bied daarnaast een llms.txt met de belangrijkste pagina's en een schone sitemap aan.
Meten wat ze doen
AI-crawlers verschijnen niet in Search Console. Je ziet ze uitsluitend in je serverlogs of CDN-analytics. Bouw een maandelijks rapport met hits per bot, meest opgehaalde secties en statuscodes. Zie je een bot verdwijnen, controleer dan direct je robots.txt, firewall en 5xx-percentage. Combineer dit met een promptset-meting om crawl en citatie aan elkaar te koppelen.
Veelgestelde vragen
Wat zijn AI-crawlers?+
AI-crawlers zijn bots van AI-aanbieders die webpagina's ophalen voor modeltraining, voor een eigen zoekindex of om tijdens een gesprek live een antwoord te onderbouwen.
Moet ik GPTBot blokkeren?+
Alleen als je content niet in trainingsdata wilt. Wil je zichtbaar zijn in AI-antwoorden, laat dan in elk geval de zoek- en antwoordbots toe, want zonder crawl geen citatie.
Wat is het verschil tussen Googlebot en Google-Extended?+
Googlebot crawlt voor de zoekindex; Google-Extended bepaalt of je content gebruikt mag worden voor Gemini-training. Google-Extended blokkeren raakt je zoekrankings niet.
Houden AI-crawlers zich aan robots.txt?+
De grote aanbieders wel. Scrapers en onbekende bots negeren het; die blokkeer je op firewall- of CDN-niveau.
Hoe zie ik of AI-crawlers mijn site bezoeken?+
In je serverlogs of CDN-analytics, gefilterd op user-agents als GPTBot, OAI-SearchBot, ClaudeBot en PerplexityBot. Search Console toont deze bots niet.
Verder lezen
Gerelateerde artikelen
Alles in de kennisbank →GEO & AI-zoekmachines
WordPress omzetten naar Lovable · Complete migratiegids 2026
Stap voor stap van WordPress naar een Lovable-site: contentexport, URL-mapping en 301-redirects, SEO- en GEO-fundament, CMS-keuze, kosten en livegang zonder rankingverlies.
Lees meerSEO fundamenten
Linkbuilding uitbesteden · Kosten, keuze & valkuilen 2026
Zelf doen of uitbesteden? Het omslagpunt, marktprijzen per link, 8 rode vlaggen bij bureaus, contractafspraken en hoe je resultaat na 6 maanden beoordeelt.
Lees meerSEO fundamenten
Wat kost linkbuilding? · Eerlijke prijsgids 2026
Prijzen per backlink (€ 90–600) en per traject, de vijf factoren achter de prijs, wat je per maandbudget krijgt en een ROI-rekenmodel in vier stappen.
Lees meerSEO fundamenten
Linkbuilding strategie · Stappenplan met gap-analyse
Van gap-analyse tegen de top 3 naar maandcadans: paginaprioritering (60-30-10), 9 tactieken, anchor-plan, interne doorstroming en kwartaalreview.
Lees meerAlles over dit thema op één plek: hub AI-strategie
Ready?
Klaar om gespot te worden?
Plan een gratis kennismaking van 30 minuten. We kijken mee naar je huidige vindbaarheid en vertellen eerlijk wat we zouden doen — wel of geen samenwerking.
Stuur ons een bericht