Terug naar blogGEO · STAPPENPLAN

AI-crawlers toestaan of blokkeren?

GPTBot, ClaudeBot, PerplexityBot, GoogleOther, Amazonbot en Bytespider crawlen je site vandaag al. Wat doen ze, hoe stuur je ze via robots.txt, en wanneer kies je voor toestaan of blokkeren?

Organiq Grow · 17 augustus 2026 · 8 min leestijd

Direct antwoord: toestaan of blokkeren?

Voor de meeste MKB-bedrijven die zichtbaar willen zijn in AI-antwoorden (ChatGPT, Perplexity, Google AI Overviews): toestaan. Blokkeren is vooral zinvol als je primair leeft van directe bezoekers of advertentie-inkomsten op je eigen content en een vergoeding wilt voor hergebruik door AI-bedrijven — denk aan nieuwsmedia en uitgevers, niet aan een lokaal dienstverlenend MKB-bedrijf.

De keuze is niet alles-of-niets. Je kunt per bot een bewuste beslissing nemen: de ene crawler levert directe zichtbaarheidswaarde met bronvermelding, de andere traint alleen een model zonder duidelijke waarde terug.

De belangrijkste AI-crawlers op een rij

Zes crawlers zie je het vaakst in je serverlogs. Elk hoort bij een ander AI-platform, met een ander doel en een ander standaardgedrag.

CrawlerVanDoelStandaardgedrag
GPTBotOpenAITraint en verrijkt ChatGPT-antwoordenCrawlt tenzij geblokkeerd via robots.txt
ClaudeBotAnthropicTraining + realtime retrieval voor ClaudeCrawlt tenzij geblokkeerd via robots.txt
PerplexityBotPerplexityLive-antwoorden met broncitatiesCrawlt tenzij geblokkeerd via robots.txt
GoogleOther / Google-ExtendedGoogleTrainingsdata voor Gemini, los van Google ZoekenCrawlt tenzij geblokkeerd via robots.txt
AmazonbotAmazonAlexa en AI-dienstenCrawlt tenzij geblokkeerd via robots.txt
BytespiderByteDance (TikTok)Trainingsdata voor TikTok- en Doubao-modellenCrawlt vaak agressief; meldingen dat robots.txt niet altijd gerespecteerd wordt

Hoe blokkeer je een AI-crawler via robots.txt

Blokkeren doe je per user-agent in je robots.txt. Onderstaand voorbeeld sluit alle grote AI-trainingscrawlers uit, terwijl Googlebot (de klassieke zoekindex-crawler) gewoon toegang houdt:

User-agent: GPTBot — Disallow: / · User-agent: ClaudeBot — Disallow: / · User-agent: PerplexityBot — Disallow: / · User-agent: Google-Extended — Disallow: / · User-agent: Amazonbot — Disallow: / · User-agent: Bytespider — Disallow: /

Let op: robots.txt is een verzoek, geen technische afsluiting. De meeste grote AI-bedrijven respecteren het netjes, maar er zijn herhaalde meldingen dat Bytespider zich er niet altijd aan houdt. Voor een harde blokkade heb je een extra laag nodig via je CDN of firewall (bijvoorbeeld de AI-bot-blocking-functie van Cloudflare).

De trade-offs: wat je wint en verliest

Blokkeren beschermt je content tegen training zonder vergoeding en bespaart bandbreedte bij agressieve crawlers. Maar het heeft een directe keerzijde: blokkeren betekent onzichtbaar zijn in AI-antwoorden. Geen citaties, geen brand-mentions in ChatGPT- of Perplexity-antwoorden, geen kans om als bron te worden aangehaald wanneer een potentiële klant een AI-tool om advies vraagt.

Voor een dienstverlenend MKB-bedrijf is dat een reële omzetafweging: elke AI-conversatie waarin je niet genoemd wordt, is een potentiële lead die naar een concurrent gaat die wél toegankelijk is voor deze crawlers.

Aanbeveling per bedrijfstype

MKB dat leads en zichtbaarheid wil (de meerderheid van onze klanten): sta alle grote AI-bots toe. De zichtbaarheidswinst weegt vrijwel altijd op tegen het risico van contenthergebruik.

Content-uitgevers en nieuwsmedia die primair leven van abonnementen of advertenties op hun eigen content: overweeg selectief blokkeren, of onderhandel over een licentie — vergelijkbaar met de deals die grote uitgevers en platforms als Reddit met AI-bedrijven hebben gesloten.

E-commerce met prijsgevoelige data: overweeg specifiek prijs-scraping-bots te blokkeren, maar houd de grote AI-crawlers open voor productvindbaarheid in AI-shopping-antwoorden.

Praktisch voorbeeld: bewust toestaan

Toestaan vraagt meestal geen actie: zonder Disallow-regel voor een user-agent crawlt de bot gewoon. Voor de duidelijkheid documenteren veel bedrijven dat toch expliciet in robots.txt, zodat toekomstige beheerders in één oogopslag zien dat de keuze bewust is gemaakt, niet per ongeluk vergeten.

User-agent: GPTBot — Allow: / · User-agent: ClaudeBot — Allow: / · User-agent: PerplexityBot — Allow: /

Let op: Google-Extended is niet Googlebot

Google-Extended is een apart token, specifiek voor het trainen van Gemini en andere AI-producten — losstaand van de klassieke Googlebot die je site indexeert voor Google Zoeken. Je kunt AI-training bij Google blokkeren zonder je organische ranking te raken, zolang je Googlebot zelf niet blokkeert. Controleer dit onderscheid altijd voordat je een blanket-regel toevoegt.

Twijfel je welke crawlers je moet toestaan?

Vraag een GEO-strategiegesprek aan
VEELGESTELDE VRAGEN

Alles over AI-crawlers

De meest gestelde vragen over GPTBot, ClaudeBot en de rest.

Blokkeert robots.txt AI-crawlers gegarandeerd?

Nee. robots.txt is een verzoek, geen technische blokkade. De meeste grote AI-bedrijven respecteren het netjes, maar met name Bytespider kreeg kritiek omdat het de regels niet altijd zou volgen. Voor een harde blokkade heb je firewall- of CDN-regels nodig, bijvoorbeeld de AI-bot-blocking-functie van Cloudflare.

Wat is het verschil tussen GPTBot en realtime browsing-agents van ChatGPT?

GPTBot is de trainings- en indexeringscrawler van OpenAI. Daarnaast bestaan er realtime browsing-agents die een pagina ophalen op het moment dat een gebruiker een vraag stelt aan ChatGPT en om actuele info vraagt. Beide typen kun je apart aansturen in je robots.txt met hun eigen user-agent-naam.

Verliezen we onze Google-ranking als we AI-bots blokkeren?

Nee, mits je Googlebot zelf niet blokkeert. Google-Extended (voor AI-training) is een apart token van de klassieke Googlebot die je site indexeert voor Google Zoeken. Je kunt het één blokkeren zonder het andere te raken.

Moeten we alle AI-bots hetzelfde behandelen?

Nee, een bewuste keuze per bot levert het meeste op. Sommige crawlers leveren directe zichtbaarheidswaarde met bronvermelding (Perplexity citeert bijvoorbeeld vaak met een klikbare link), andere trainen alleen een model zonder duidelijke waarde terug voor jouw merk.

Is er een tussenweg tussen volledig toestaan en volledig blokkeren?

Ja. Je kunt selectief toestaan (bijvoorbeeld wel Perplexity en GPTBot, niet Bytespider), of toestaan combineren met rate-limiting via je CDN om serverbelasting te beperken zonder de bot volledig te weren.

Zelf aan de slag of uitbesteden?

Toepassen wat je hier las? Dit zijn de logische vervolgstappen als je het liever aan een bureau overlaat.

Lees verder

In deze serie

Klaar voor AI-zichtbaarheid?

Word geciteerd
door ChatGPT en Google AI.

We stellen een GEO-strategie op die past bij jouw branche: welke crawlers je toelaat, welke content je herstructureert en hoe je meet of het werkt.