Controleer in één klik of GPTBot, ClaudeBot, Google-Extended en andere AI-crawlers je pagina’s mogen lezen — of dat je robots.txt ze stilletjes blokkeert.
AI-crawlers zijn bots van bedrijven als OpenAI, Anthropic en Google die openbare pagina’s lezen om hun modellen en antwoordmachines te voeden. Kunnen ze je site lezen, dan kan je merk verschijnen in ChatGPT, Claude, Perplexity en AI Overviews.
Je robots.txt-bestand — een tekstbestand in de root van je domein — vertelt deze bots waar ze bij mogen. Eén enkele Disallow-regel kan je stilletjes uit AI-antwoorden halen.
Typ je webadres. Wij halen je openbare /robots.txt-bestand op.
We vergelijken elke grote AI-crawler met je User-agent- en Disallow-regels.
Krijg in seconden een duidelijke status toegestaan / geblokkeerd voor elke AI-crawler.
Je robots.txt-bestand is een platte tekstbestand in de root van je domein dat geautomatiseerde bots vertelt welke delen van je site ze wel en niet mogen ophalen. Twee decennia lang stuurde het zoekmachinespiders zoals Googlebot aan. Vandaag heeft het een tweede, even belangrijke taak: bepalen welke AI-crawlers — de bots die ChatGPT, Perplexity, Claude en de generatieve antwoorden van Google voeden — je inhoud mogen lezen.
AI-aanbieders draaien afzonderlijke user-agents voor afzonderlijke doelen. OpenAI gebruikt GPTBot om trainingsdata te verzamelen, OAI-SearchBot om live zoekantwoorden in ChatGPT te voeden, en ChatGPT-User voor ophalen op aanvraag wanneer een gebruiker ChatGPT vraagt een link te openen. Anthropic draait ClaudeBot en het oudere anthropic-ai. Perplexity gebruikt PerplexityBot. Google gebruikt Google-Extended als opt-out-token voor het trainen van Gemini, los van zijn zoekcrawler Googlebot. De CCBot van Common Crawl voedt veel onderliggende modellen, en Bytespider (ByteDance), Amazonbot en Applebot-Extended maken de lijst compleet.
Het kerninzicht is dat deze bots verschillende dingen doen, dus een algeheel blok is zelden de juiste keuze. Een trainingscrawler blokkeren beschermt je inhoud tegen opname in een model, maar een live-retrieval-bot zoals OAI-SearchBot of PerplexityBot blokkeren kan je stilletjes verwijderen uit de AI-antwoorden die je kopers zien — het AI-equivalent van jezelf de-indexeren uit Google. De meeste merken willen het tegenovergestelde: maximale zichtbaarheid in AI-antwoorden, met selectieve controle over grootschalig scrapen.
robots.txt is een richtlijn, geen harde muur. Betrouwbare crawlers van OpenAI, Anthropic, Perplexity en Google houden zich eraan, maar het hangt af van de keuze van de bot om te gehoorzamen. Het is de standaard, wrijvingsloze manier om je voorkeuren uit te drukken, en het koppelen aan een llms.txt-bestand geeft welopgevoede AI-systemen een heldere kaart van de inhoud die je het liefst gebruikt ziet.
Een praktische volgorde om te controleren wat je vandaag toestaat, de deuren te openen die je AI-zichtbaarheid vergroten en die te sluiten die je niet wilt — zonder je per ongeluk te verbergen voor ChatGPT en Perplexity.
Laat je domein door deze checker lopen om te zien welke AI-user-agents je vandaag toestaat, blokkeert of gedeeltelijk blokkeert. Veel sites blokkeren GPTBot of PerplexityBot onbewust, door een gekopieerde regel of een standaardinstelling van een beveiligingsplugin.
Scheid live-retrieval-bots (OAI-SearchBot, ChatGPT-User, PerplexityBot) van trainingsbots (GPTBot, Google-Extended, CCBot, ClaudeBot). De meeste merken staan retrieval-bots toe voor zichtbaarheid en maken een bewuste keuze over trainingsbots.
Om in ChatGPT- en Perplexity-antwoorden te verschijnen, sta je OAI-SearchBot, ChatGPT-User en PerplexityBot expliciet toe. Als je wilt dat je inhoud ook voor training wordt gebruikt, sta dan ook GPTBot en ClaudeBot toe.
Als bandbreedte, grootschalig scrapen of hergebruik zonder bronvermelding een zorg zijn, voeg dan Disallow-regels toe voor agressieve crawlers zoals Bytespider, CCBot of Amazonbot, terwijl je de antwoordmachine-bots toegestaan laat.
Gebruik één User-agent-blok per bot, noem de user-agent woordelijk en plaats Allow: / of Disallow: / eronder. Een te brede slotregel kan veel meer blokkeren dan bedoeld, dus houd elke richtlijn nauw afgebakend.
Voer deze checker opnieuw uit nadat je robots.txt hebt bewerkt om te bevestigen dat elke bot wordt gelezen zoals je bedoelde. Controleer of het bestand HTTP 200 teruggeeft op /robots.txt en niet wordt geblokkeerd door een firewall, CDN of WAF-regel.
Publiceer een llms.txt die je belangrijkste pagina’s en documentatie opsomt. Het vult robots.txt aan door welopgevoede AI-systemen naar de inhoud te wijzen die je het liefst geciteerd ziet.
AI-aanbieders voegen regelmatig user-agents toe en hernoemen ze. Controleer elk kwartaal opnieuw, houd je serverlogs in de gaten op nieuwe AI-bots en bevestig dat een CDN-update of een nieuwe plugin je regels niet stil heeft gewijzigd.
Het vocabulaire om AI-bots aan te sturen, in heldere taal.
Als kopers je onderzoeken via AI-assistenten, bepaalt je robots.txt nu of ze je kunnen lezen.
Bepaal bewust of je trainingscrawlers zoals GPTBot en CCBot toestaat, terwijl je antwoordmachine-bots zoals OAI-SearchBot en PerplexityBot toegestaan houdt zodat je berichtgeving geciteerd blijft.
Bevestig dat ChatGPT en Perplexity je documentatie en functiepagina’s kunnen lezen, zodat je site beschikbaar is om geciteerd te worden wanneer kopers de AI om de beste tool in je categorie vragen.
Zorg dat product- en categoriepagina’s crawlbaar zijn voor AI-shopantwoorden en beperk selectief agressieve scrapers die je servers belasten zonder verkeer te sturen.
Controleer de robots.txt van een klant in seconden, spot per ongeluk geblokkeerde GPTBot of PerplexityBot en maak van de oplossing een heldere, meetbare AI-zichtbaarheidswinst.
Toegang is stap één. Ontdek of AI-engines je merk echt aanbevelen — en hoe je dat voor elkaar krijgt.
Mijn gratis RAIVE-score ophalen