Close-up van een beeldscherm vol gekleurde regels code in het donker.
Nieuws22 augustus · 02:105 min leestijd

Cloudflare synchroniseert je robots.txt met je AI-botinstellingen

Bot Preference Sync schrijft de keuzes voor Search, Agent en Training uit je Cloudflare-dashboard automatisch in je robots.txt. Komende week op elk abonnement, en training blokkeren kost je zoekzichtbaarheid niet meer.

Cloudflare schrijft je AI-botkeuzes voortaan zelf in je robots.txt: Bot Preference Sync synchroniseert de instellingen voor Search, Agent en Training uit het dashboard met dat bestand en komt komende week beschikbaar op elk abonnement, van gratis tot Enterprise.

Wie zijn site achter Cloudflare draait, moest dezelfde keuze tot nu toe twee keer vastleggen: met de hand per user-agent in robots.txt, en nog eens in de botinstellingen die het aan de rand van het netwerk afdwingen. Dat dubbele boekhouden verdwijnt. Voor een Nederlandse webshop of uitgever verschuift de vraag daarmee van "staat het overal goed" naar "wat wil je eigenlijk", en dat blijft een keuze per functie: trainingsbots weren en zoekbots juist binnenlaten.

Wat Cloudflare in je bestand zet

Bot Preference Sync maakt of werkt je robots.txt bij op basis van je configuratie op zoneniveau. Heb je al een robots.txt, dan zet Cloudflare zijn regels ervoor, tussen de markeringen # BEGIN Cloudflare Bot Preference Sync en # END Cloudflare Bot Preference Sync. Je eigen Disallow-regels blijven daaronder gewoon staan.

Welke user-agents in dat blok belanden houdt Cloudflare bij via BotBase, zijn catalogus van bekende bots en agents; de geverifieerde bots die als Search, Agent of Training zijn ingedeeld zijn na te kijken in de openbare botdirectory op Cloudflare Radar.

Het is een categoriebrede schakelaar, geen fijnregeling. Heb je een aparte afspraak met een AI-bedrijf en staat die in een eigen regel met complexere logica, dan leest de sync die niet mee. Voor dat geval kun je de sync uitzetten en je bestand zelf blijven beheren.

Cloudflare-dashboard met Search en Agent op toestaan, Training op Disallow en een schakelaar die de voorkeuren in robots.txt weerspiegelt. Bron: Cloudflare
Cloudflare-dashboard met Search en Agent op toestaan, Training op Disallow en een schakelaar die de voorkeuren in robots.txt weerspiegelt. Bron: Cloudflare

Training blokkeren kost je zoekzichtbaarheid niet meer

Voor Search en Agent blijven de drie opties van 1 juli staan: toestaan, blokkeren op pagina's met advertenties, of overal blokkeren. Bij Training verandert de betekenis van de blokkade. Kies je Disallow, dan komt er een "geen training"-voorkeur in je robots.txt, en crawlers die zich daaraan houden mogen je pagina's blijven indexeren voor zoekresultaten. Je zichtbaarheid in zoeken blijft bij die crawlers dus intact.

Dat is een verschuiving ten opzichte van juli, toen een crawler die zoeken, agent-taken en training onder een en dezelfde user-agent mengde nog op al zijn gedragingen samen werd beoordeeld. Nu koppelt Cloudflare het voordeel van de twijfel aan transparantie. Een bot die zowel zoekt als traint ontkomt alleen aan de blokkade als hij vier dingen laat zien: dat hij een "geen training"-voorkeur respecteert, dat sitehouders zich kunnen afmelden voor AI-samenvattingen, dat per URL zichtbaar is welke pagina's voor training beschikbaar waren en wat de zoekcijfers zijn, en publiek bewijs dat training weigeren de gewone zoekresultaten niet schaadt. Levert een operator dat niet, dan blijft hij geblokkeerd zodra je training uitzet. Cloudflare houdt in de AI-transparantiesectie van Radar bij wie zich eraan houdt en wie niet, en verificatie vraagt sowieso eerlijke zelfidentificatie en niet-misbruikend gedrag.

Wat er standaard aan komt te staan

Bij nieuwe klanten staat de sync standaard aan. Geeft zo'n klant bij het aanmelden aan geld te verdienen met advertentiepagina's, dan zet Cloudflare Training meteen op Disallow, aan te passen wanneer je wilt. Alle andere nieuwe klanten krijgen bij het aanmelden geen enkele blokkade of disallow: het beginpunt is leeg. Bestaande klanten die nog op de oude beheerde robots.txt zitten, krijgen bij de lancering een melding in hun dashboard en hun mailbox om hun voorkeuren te bevestigen.

Dat aanmeldmoment doet meer werk dan het lijkt, want de meeste sites komen nooit aan een bewuste keuze toe. Bij een steekproef onder Nederlandse webshops noemde 83 procent geen enkele AI-crawler in zijn robots.txt, waardoor niet de eigenaar maar de standaard van de hosting of een securityplug-in besliste wie de catalogus mocht ophalen.

Een voorkeur is nog geen slot

Cloudflare zet het zelf in hetzelfde scherm: dit garandeert niet dat bots zich aan robots.txt houden. Metingen van TollBit lieten deze maand zien dat ongeveer 15 procent van de AI-fetchers in Europa geblokkeerde pagina's alsnog ophaalt. Het bestand spreekt je voorkeur uit, de blokkade aan de rand van het netwerk dwingt hem af. Bot Preference Sync lost geen van beide op, het zorgt er alleen voor dat de twee hetzelfde zeggen, en dat is precies het gat waar crawlers volgens Cloudflare misbruik van maken.

De klok tikt ondertussen door. Op 15 september 2026 blokkeert Cloudflare trainings- en agent-crawlers standaard op advertentiepagina's van nieuwe domeinen, terwijl bestaande klanten tot die datum zelf bepalen of ze meegaan. Wie zijn keuze in de weken daarvoor bewust maakt, hoeft hem daarna nog maar op een plek te zetten.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Instellingen die elkaar volgen

Een keuze die op twee plekken hetzelfde moet zeggen loopt vroeg of laat uit elkaar, of dat nu je robots.txt en je firewall zijn of je webshop en je boekhouding. Ik denk mee over wat je wilt, ontwerp het, bouw het en automatiseer het daarna zo dat het zichzelf gelijk houdt, zelf gehost waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

15 procent van de AI-fetchers in Europa haalt geblokkeerde pagina's op
Nieuws
6 min

15 aug 16:08

15 procent van de AI-fetchers in Europa haalt geblokkeerde pagina's op

Ongeveer 15 procent van de herkende AI-fetchers in Europa haalde pagina's op die sites in robots.txt hadden verboden, meet TollBit. Drie bots kwamen op bijna de helft van de sites die hen noemden alsnog binnen.

AI-crawlers toelaten of blokkeren: een keuzegids voor je robots.txt en Cloudflare-instellingen
Gids
9 min

2 jul 09:00

AI-crawlers toelaten of blokkeren: een keuzegids voor je robots.txt en Cloudflare-instellingen

Geef je GPTBot, ClaudeBot en soortgenoten toegang of hou je ze buiten? Een stappenplan om per crawler te beslissen, het correct in te stellen en de impact te meten.

Je hebt opgeschreven wat je AI-agent mag. Alleen weet niemand wie hij is.
Inzicht
7 min

9 jul 13:03

Je hebt opgeschreven wat je AI-agent mag. Alleen weet niemand wie hij is.

AI-agenten krijgen nu een eigen digitale identiteit, van Okta en de Linux Foundation tot Estland. Wie zijn agent op geleende inloggegevens laat draaien, verliest het zicht op wie er namens hem handelt.

Google lanceert ARD: open standaard waarmee AI-agenten zelf hun tools vinden
Nieuws
5 min

18 jun 16:16

Google lanceert ARD: open standaard waarmee AI-agenten zelf hun tools vinden

Met Agentic Resource Discovery publiceert Google een open specificatie waarmee AI-agenten zelfstandig tools, skills en MCP-servers opzoeken en hun herkomst verifiëren. GitHub, Microsoft en Hugging Face doen mee.

wikiHow klaagt OpenAI aan om training en RAG-ophalen van zijn artikelen
Nieuws
5 min

24 aug 22:13

wikiHow klaagt OpenAI aan om training en RAG-ophalen van zijn artikelen

wikiHow sleept negen OpenAI-entiteiten voor de rechter in Manhattan en betwist naast de AI-training ook het live ophalen van zijn how-to-artikelen bij elk antwoord. Die retrieval-claim raakt iedereen die AI op andermans content laat zoeken.

Anthropics goedkopere Opus 5 passeert topmodel Fable 5 in zakelijke bestedingen
Nieuws
4 min

23 aug 18:11

Anthropics goedkopere Opus 5 passeert topmodel Fable 5 in zakelijke bestedingen

Anthropics goedkopere Opus 5 heeft topmodel Fable 5 voorbij in zakelijke bestedingen, meldt de Financial Times. Fable 5 blijft steken op ongeveer 11 procent van wat bedrijven bij Anthropic uitgeven.