OpenAI kondigt op 5 oktober aan dat het de komende weken bij gebruik van ChatGPT en Codex op alle abonnementen in de EU een onzichtbaar statistisch watermerk toevoegt aan geschikte tekstuitvoer.
Voor teams die klantmails, rapporten of publicatieteksten met ChatGPT maken, verandert de herkomst van geschikte productuitvoer: het merkteken reist onzichtbaar mee. Wie OpenAI via de API gebruikt, krijgt geen automatische markering, maar kan die wereldwijd per geselecteerd model activeren.
ChatGPT en Codex krijgen een EU-route
OpenAI noemt het systeem textGrain: een statistisch patroon in modelkeuzes dat een detector kan herkennen. Het technische rapport legt uit hoe een terugvindbaar signaal ontstaat uit woordkeuzes tijdens generatie.

OpenAI zegt het watermerk bij de start niet wereldwijd standaard in te schakelen. API-klanten kunnen de markering vanaf nu wereldwijd zelf aanzetten voor geselecteerde modellen; de instelling blijft standaard uit. Het bedrijf werkt met cloudpartners aan ondersteuning in de komende weken en wil textGrain later als open source beschikbaar maken.
De detector blijft aanvankelijk achter een aanvraag. Goedgekeurde onderzoekers en expertorganisaties kunnen toegang vragen; OpenAI beoordeelt aanvragen per geval.
Een providermerk is geen publiekslabel
Artikel 50 van de AI-verordening geldt sinds 2 augustus 2026. Het verdeelt taken tussen de aanbieder van een AI-systeem en de organisatie die het gebruikt. Aanbieders moeten AI-uitvoer machineleesbaar markeren. Voor systemen die vóór 2 augustus al op de markt waren, loopt de markeringstermijn tot 2 december. Een organisatie die AI-tekst publiceert om het publiek over een onderwerp van algemeen belang te informeren, moet die tekst duidelijk labelen. Dat hoeft niet als een deskundige de inhoud beoordeelt of een verantwoordelijke redactie de publicatie inhoudelijk controleert.
De Europese Commissie beperkt de gebruikersplicht tot zulke publicaties en zondert broncode en standaardredactie uit van de aanbiedersmarkering. Voor de gebruikersplicht geldt een andere toets: een spellingscontrole telt niet als inhoudelijke beoordeling. Die moet de betekenis en feiten raken en gebeuren door iemand met kennis van het onderwerp. Daaruit volgt dat het technische watermerk en een zichtbaar publiekslabel verschillende functies hebben.
Voor Codex laat OpenAI een praktische vraag open. De aankondiging noemt geschikte tekstuitvoer, maar zegt niet precies welke uitvoer in aanmerking komt. Omdat broncode buiten de markeerplicht voor aanbieders valt, valt uit de aankondiging niet af te leiden of een gegenereerde codewijziging een watermerk krijgt. OpenAI zegt ook dat een markering niet vaststelt wie de tekst schreef, hoeveel mensen eraan bijdroegen, of de inhoud klopt en of een zichtbare melding verplicht is.
De detector levert geen auteursbewijs
OpenAI beperkt toegang tot goedgekeurde onderzoekers en expertorganisaties, mede omdat de detector watermerken kan missen of ten onrechte kan aanwijzen. Bij een doelpercentage van 1 procent foutpositieven vond de test het merkteken in ongeveer 80 procent van passages van 200 tokens over psychologie. Bij 400 tokens was dat ongeveer 95 procent. De detectie lag veel lager bij wiskundige tekst, waar woordkeuzes beperkter zijn.
Bewerking verzwakte het signaal verder. In een proef met 400 tokens bracht vervanging van 10 procent van de woorden door synoniemen de detectie van 92 naar 66 procent. Bij 25 procent vervanging daalde de detectie naar 17 procent, meldt The Decoder. Een treffer geeft hooguit een signaal dat OpenAI’s systeem bij de tekst betrokken was. De detector identificeert geen gebruiker of gesprek. Het ontbreken van een treffer bewijst evenmin dat een mens de tekst schreef.
OpenAI meldt geen betekenisvolle prestatieverschillen op acht benchmarks voor zijn nieuwste model Astra. De cijfers uit de eigen vergelijking zijn:
| Benchmark | Zonder watermerk | Met watermerk |
|---|---|---|
| Artificial Analysis Intelligence Index | 49,57 punten | 49,76 punten |
| AutomationBench | 34,09% | 34,86% |
| DeepSWE v1.1 | 72,80% | 71,68% |
| Terminal-Bench 4.0 | 53,90% | 56,06% |
| Terminal-Bench Science 0.1 | 56,90% | 60,00% |
| BrowseComp | 87,92% | 87,35% |
| HealthBench Professional | 64,27% | 64,60% |
| GPQA Diamond | 94,44% | 93,94% |
Het zijn OpenAI-metingen voor één model. De acht tests zeggen niet hoe andere ChatGPT- en Codex-modellen presteren of hoe de markering uitpakt in Nederlandse klantteksten.
Anthropic kiest voor wereldwijde dekking
Anthropic markeert uitvoer van ondersteunde Claude-modellen wereldwijd, via Claude, Claude Code, Cowork, de API en cloudpartners. In augustus kondigde het een wereldwijd watermerk op Claude-tekst aan. De uitrol omvat inmiddels Fable 5.1 en Mythos 5.1; hun tekst wordt gemarkeerd terwijl de detectie-API besloten blijft.
OpenAI begint met geschikte productuitvoer in de EU en laat API-klanten wereldwijd zelf kiezen. Anthropic past het bij ondersteunde modellen wereldwijd toe. De tekstcontrole van beide bedrijven blijft voorlopig beperkt tot goedgekeurde groepen. Voor Nederlandse publicatieteams lopen twee vragen naast elkaar: welke tool of API heeft de tekst verwerkt, en valt de uiteindelijke publicatie onder de zichtbare labelplicht van artikel 50? Het watermerk voegt een technisch herkomstsignaal toe; de inhoudelijke beoordeling en publicatiebeslissing blijven bij de organisatie die de tekst uitgeeft.
Veelgestelde vragen
Herkomst in je publicatiestroom
Ik denk mee over AI-publicatiebeleid en ontwerp de controles die je team nodig heeft. Daarna realiseer en automatiseer ik het hele traject, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
