Blog · Techniek & Tooling
AI-crawlers: blokkeren of toelaten? Het beslismodel voor 2026
Je robots.txt is in 2026 een strategisch document geworden: per crawler beslis je wie je content mag lezen, trainen of citeren. Blind alles blokkeren kost zichtbaarheid in AI-antwoorden, maar alles toelaten is óók een keuze. Dit is het beslismodel per bot, met concrete regels die je vandaag kunt overnemen.
Door Amanda, Content Strategist & GEO Editor · Laatst bijgewerkt:
Belangrijkste punten
- Scheid drie functies: crawlen voor zoekindex, crawlen voor AI-antwoorden en crawlen voor modeltraining.
- Blokkeren van trainingscrawlers (GPTBot, CCBot) belemmert citaties in antwoorden niet — dat zijn verschillende bots.
- Wil je zichtbaar zijn in ChatGPT en Perplexity, dan moeten OAI-SearchBot en PerplexityBot gewoon toegang hebben.
- Meet eerst welke bots je nu al bezoeken via je serverlogs voordat je besluiten neemt.
- Leg je keuze vast in een AI-beleid: wie mag wat, en waarom.
Drie soorten crawlers, drie verschillende belangen
De discussie over AI-crawlers wordt vaak gevoerd alsof het één groep is. In werkelijkheid zijn het drie functies met totaal verschillende gevolgen voor jouw zichtbaarheid.
- Zoekcrawlers (Googlebot, Bingbot): bouwen de klassieke index. Blokkeren betekent uit Google verdwijnen.
- Antwoordcrawlers (OAI-SearchBot, PerplexityBot, Gemini's live-fetch): halen je pagina op wanneer een gebruiker een vraag stelt. Blokkeren betekent nooit geciteerd worden.
- Trainingscrawlers (GPTBot, CCBot, Google-Extended): verzamelen content om modellen te verbeteren. Blokkeren kost je geen directe zichtbaarheid.
Die scheiding is de kern: je kunt trainingsdata weigeren én toch volledig citeerbaar blijven. Dat onderscheid missen de meeste robots.txt-bestanden die we in audits tegenkomen.
Wat blokkeren je wél en niet kost
De angst "als ik niet blokkeer, stelen ze mijn content" is begrijpelijk maar incompleet. De juiste vraag is: wat is de waarde van mijn content als trainingsmateriaal, en wat is de waarde van mijn content als citaat in een antwoord?
Voor de meeste dienstverleners en B2B-organisaties is de citatiewaarde vele malen groter. Je kennisbank en dienstenpagina's zijn marketingmateriaal, geen beschermd product. Wie ze blokkeert, blokkeert vooral zichzelf uit het snelst groeiende verkeerskanaal.
Anders ligt het bij uitgevers en makers van premium content: als de tekst zelf het product is, is toestemming zonder licentie een reëel commercieel dilemma. Die groep kiest terecht steeds vaker voor blokkeren van trainingsbots plus actief onderhandelen over licenties.
Een pragmatische robots.txt-opzet voor 2026
Een werkende standaardconfiguratie die we bij klanten inzetten:
- Zoekcrawlers: volledig toestaan, met een schone sitemap en zonder Disallow op contentpaden.
- Antwoordcrawlers (OAI-SearchBot, PerplexityBot, ClaudeBot voor antwoorden): expliciet toestaan.
- Trainingscrawlers (GPTBot, CCBot, Google-Extended): naar keuze blokkeren — dit kost geen citaties.
- Scraper-achtige bots zonder duidelijke eigenaar of UA: blokkeren op serverniveau.
Let op: robots.txt is een verzoek, geen slot. Serieuzere partijen respecteren het; kwaadwillenden niet. Wie echt wil afschermen, moet op WAF- of serverniveau werken met UA-filtering en rate-limiting.
Meet eerst, beslis dan
Voordat je regels schrijft: kijk in je serverlogs of CDN-dashboard welke AI-bots je nu al bezoeken en hoe vaak. In de praktijk zien we drie verrassingen terugkomen: sites die denken dat ze geblokkeerd zijn maar het niet zijn, sites die ongemerkt hun antwoordcrawlers blokkeren door een te brede wildcard, en sites waar PerplexityBot de op twee na actiefste bot is zonder dat de eigenaar het weet.
Leg daarna je keuze vast in een kort AI-beleid van één pagina: welke bots zijn welkom, welke niet, en wie beslist bij nieuwe crawlers. Nieuwe bots verschijnen maandelijks; zonder beleid wordt elke keer opnieuw geïmproviseerd.
Veelgestelde vragen
Verdwijn ik uit ChatGPT als ik GPTBot blokkeer?+
Nee. GPTBot verzamelt trainingsdata; antwoorden in ChatGPT komen via OAI-SearchBot en live ophalen. Je kunt trainingsdata weigeren en toch geciteerd worden, mits je de antwoordcrawler toelaat.
Respecteren AI-bedrijven robots.txt wel?+
De grote partijen (OpenAI, Anthropic, Google, Perplexity) publiceren hun crawler-namen en respecteren robots.txt. Kleinere scrapers doen dat wisselend — die filter je beter op serverniveau.
Moet ik een ai.txt of llms.txt naast robots.txt zetten?+
llms.txt is een handige inhoudsopgave voor modellen, maar geen toegangsmechanisme. Toegang regel je via robots.txt en serverregels; zie llms.txt als een menukaart, niet als een deur.
Hoe check ik welke AI-bots mijn site bezoeken?+
Filter je serverlogs of CDN-analytics op user agents als GPTBot, ClaudeBot, PerplexityBot en OAI-SearchBot. Bij Cloudflare zit dit standaard in de bot-analytics.
Verder lezen
AI-content en vertrouwen: waarom authenticiteit in 2026 je grootste rankingfactor is
Teams schrijven sneller met AI, maar lezers voelen het verschil — en zowel Google als AI-antwoordmachines belonen herkenbare, verifieerbare bronnen. Dit is het redactiemodel dat snelheid en vertrouwen combineert.
Lees meerZoekgedrag verschuift naar AI: wat minder klikken betekenen voor je traffic in 2026
Je posities blijven staan, je klikken dalen. Dat is geen bug maar een structurele verschuiving in zoekgedrag. Zo herijk je je meting en verover je zichtbaarheid in het antwoord zelf.
Lees meerVibecoding in de praktijk: wat je in 2026 wél en niet zelf moet bouwen
Met AI bouw je in een middag een werkend prototype. De vraag is niet meer óf het kan, maar waar de grens ligt tussen slim zelf doen en dure herbouw achteraf.
Lees meerAI Overviews optimaliseren: zo word je genoemd in het antwoord van Google
AI Overviews kiezen passages, niet pagina's. Dit zijn de ingrepen die je kans op vermelding het snelst vergroten — en hoe je het meet zonder klikdata.
Lees meerMerkzichtbaarheid in ChatGPT: hoe assistenten je shortlist bepalen
Steeds meer aankopen beginnen in een chatgesprek. Wie daar niet genoemd wordt, komt niet in de overweging — dit is hoe die selectie werkt.
Lees meerAI-agents in je marketingteam: een invoermodel van vier weken
Agents automatiseren processen, geen taken. Dat verklaart waarom de meeste pilots stranden — en hoe je het wél laat werken.
Lees meerllms.txt en de machineleesbare website: hype of hygiëne?
Naast robots.txt en sitemap.xml groeit een derde bestand. Nuttig — maar de echte winst zit ergens anders.
Lees meerLow-code of custom bouwen? Een beslismodel voor 2026
De vraag is niet meer óf low-code kan, maar wanneer het verstandig is. Een beslismodel zonder ideologie.
Lees meerE-E-A-T in het AI-tijdperk: ervaring is het enige echte onderscheid
Een model kan alles genereren behalve jouw praktijkervaring. Precies daar ligt je voorsprong — als je die zichtbaar maakt.
Lees meerB2B-leadgeneratie met AI in 2026: minder berichten, beter moment
Als iedereen personaliseert met dezelfde tools, wordt personalisatie ruis. De winst zit in timing en onderzoek.
Lees meerAI-advertising: wat je in 2026 nog wél zelf moet doen
Platforms nemen targeting en biedingen over. Dat werkt — mits jij de input en de meting op orde hebt.
Lees meerContentclusters bouwen: van keywordlijst naar topical authority
Losse artikelen ranken steeds moeilijker. Een samenhangend cluster rond één onderwerp doet dat wel — als de intenties niet overlappen.
Lees meerAI en privacy: praktische AVG-kaders voor marketingteams
De meeste risico's zitten niet in de tool, maar in wat medewerkers erin plakken. Zo houd je snelheid zonder onnodig risico.
Lees meerGEO voor webshops: hoe productdata bepaalt of AI jouw assortiment noemt
Klanten vragen AI om een shortlist en komen pas daarna op je productpagina. Dit is welke data je nodig hebt om in dat antwoord te staan.
Lees meerInterne portalen bouwen met vibecoding: waar de echte winst zit in 2026
Bij een intern portaal concurreer je met Excel en een mailbox. De lat ligt lager en de winst is direct meetbaar — mits rollen en datamodel kloppen.
Lees meerAI-video en beeld in marketing: waar het rendeert en waar het schaadt
De winst zit in testvolume en lokalisatie, niet in het vervangen van echte opnames. En bij beloftes over je product stopt generatief beeld.
Lees meerDatakwaliteit: het onspannende fundament onder elk AI-project
De meeste AI-projecten falen niet op het model maar op dubbele records en drie definities van 'klant'. Zo los je dat in weken op.
Lees meerMultimodaal zoeken: vindbaar zijn als mensen met hun camera zoeken
Een groeiend deel van de zoekvraag begint met een foto in plaats van een toetsenbord. Voor de meeste sites is dit het meest onderschatte kanaal van 2026.
Lees meerVoice search in 2026: waarom GEO en spraak hetzelfde spel werden
Voice is geen apart kanaal meer maar een invoermethode van AI-antwoordmachines. Wie citeerbaar schrijft, wint automatisch ook de gesproken vraag.
Lees meerAI-chatbots op je website: waarom de kennisbasis 80% van het werk is
De toolkeuze is het makkelijkste deel. De winst zit in canonieke antwoorden, een goede overdracht aan mensen en meten op resolutie in plaats van deflectie.
Lees meerProgrammatic SEO in het AI-tijdperk: wanneer honderden pagina's nog werken
Duizenden pagina's genereren kost niets meer — precies daarom filtert Google er strenger op. Het verschil tussen een waardevolle database en een spamfarm.
Lees meerRAG uitgelegd: een AI-assistent bouwen op je eigen documenten
Je traint geen model — je bouwt een goed doorzoekbare kennislaag. De techniek is in weken klaar; het opschonen van je documentatie bepaalt de doorlooptijd.
Lees meerAI-personalisatie op je website: wat werkt en waar het creepy wordt
Personalisatie is bereikbaar voor het MKB, maar de valkuil is strategie, niet techniek. Begin met context, niet met identiteit — en test alles.
Lees meerContext engineering: de AI-vaardigheid die prompt engineering vervangt
De verschuiving van 2026: minder trucjes in de prompt, meer systeem in de invoer. Zo bouw je een contextbibliotheek die AI-output consistent maakt.
Lees meerDe AI-nieuwsbrief: een workflow die sneller draait én beter presteert
Niet de volautomatische nieuwsbrief, maar de slimme workflow wint: AI voor curatie en varianten, een mens voor selectie en stem.
Lees meerGestructureerde data voorbij de basis: van snippets naar knowledge graph
Article en FAQ kent iedereen inmiddels. Het voordeel zit in een graaf: Organization, Person, Service en Article die elkaar versterken.
Lees meerAgentic AI in marketing: wat agents nu écht kunnen en waar de grens ligt
Betrouwbaar vandaag: monitoring, research, varianten en rapportage. De kunst is de inrichting eromheen — conceptstatus, logging en een mens als eigenaar.
Lees meerMerkbouwen in het AI-tijdperk: je merk bestaat nu óók in modelantwoorden
Je merk leeft voortaan op twee plekken: in hoofden van mensen en in antwoorden van modellen. De signalen die beide voeden zijn dezelfde.
Lees meerAI-verkeer meten: een attributiemodel dat wél werkt
Je rapportage ziet 'direct' en concludeert dat content niets doet. Dit is het meetmodel dat AI-zichtbaarheid zichtbaar maakt.
Lees meerReady?
Klaar om gespot te worden?
Plan een gratis kennismaking van 30 minuten. We kijken mee naar je huidige vindbaarheid en vertellen eerlijk wat we zouden doen — wel of geen samenwerking.
Stuur ons een bericht