Vanaf de komende weken krijgen teksten die door ChatGPT en Codex in de Europese Unie worden gegenereerd, een onzichtbaar watermerk. OpenAI reageert hiermee op de Europese AI Act, al lijkt het bedrijf voor een minder strikte aanpak te kiezen dan concurrenten.
OpenAI, de ontwikkelaar van ChatGPT en Codex, zal de komende weken onzichtbare watermerken toevoegen aan teksten die door deze AI-modellen binnen de Europese Unie worden gegenereerd. Deze maatregel is een directe reactie op de Europese AI Act, die vereist dat AI-gegenereerde content herkenbaar moet zijn. Voor de browserversie van ChatGPT en Codex in de EU zal dit watermerk standaard actief zijn, terwijl API-klanten wereldwijd de optie krijgen om het in te schakelen.
Deze stap van OpenAI volgt op vergelijkbare initiatieven in de sector. Concurrent Anthropic, bijvoorbeeld, introduceerde al in augustus een onzichtbaar watermerk voor alle output van zijn Claude-model. Wij zien echter dat OpenAI een minder strenge interpretatie hanteert: waar Anthropic zijn watermerk wereldwijd en voor alle output toepast, beperkt OpenAI zich voornamelijk tot de EU. Dat duidt erop dat het bedrijf zorgvuldig de balans zoekt tussen regelgeving en het behoud van zijn klantenbestand buiten Europa.
Het watermerk, dat OpenAI ’textGrain’ noemt, werkt door subtiel de woordkeuze van de AI aan te passen. Grote taalmodellen zoals ChatGPT voorspellen het volgende woord in een zin. Het watermerk stuurt deze keuze bij, waardoor een statistisch patroon ontstaat dat later door een detector kan worden herkend. Voor de lezer blijft dit patroon onzichtbaar. Deze methode is robuust genoeg om detectie te behouden, zelfs als teksten worden gekopieerd, maar is niet onfeilbaar.
Interne tests van OpenAI tonen aan dat de detecteerbaarheid van het watermerk aanzienlijk afneemt wanneer de tekst handmatig wordt bewerkt. Het vervangen van slechts 10 procent van de woorden door synoniemen kan de detectiekans al terugbrengen van circa 92 procent naar 66 procent. Bij 25 procent aanpassingen daalt dit zelfs naar 17 procent. Korte teksten, vertalingen of content met minder flexibele woordkeuze, zoals wiskundige antwoorden, zijn ook moeilijker te markeren en te detecteren. Dit illustreert de inherente uitdagingen van dergelijke watermerksystemen en de onzekerheid die ermee gepaard gaat.
OpenAI stelt zijn detectiesysteem voorlopig enkel beschikbaar aan geselecteerde onderzoekers en gespecialiseerde instellingen. Het bedrijf benadrukt dat de technologie niet waterdicht is en zowel valse positieven als valse negatieven kan opleveren. De afwezigheid van een watermerk betekent dus niet automatisch dat een tekst door een mens is geschreven, en omgekeerd. Dit onderstreept het belang van menselijke controle en redactionele verantwoordelijkheid, zeker bij informatie van publiek belang.
De EU AI Act trad al op 2 augustus 2026 in werking voor wat betreft de markering van AI-gegenereerde inhoud. Voor systemen die vóór die datum op de markt kwamen, geldt een overgangstermijn tot 2 december 2026. Dat geeft bedrijven als OpenAI de tijd om hun systemen aan te passen. Het is daarbij opvallend dat de Europese toezichthouders niet alleen naar de leverancier van de AI kijken, maar ook naar de organisatie die de AI-tekst publiceert. Die laatste blijft verantwoordelijk voor de transparantie, zelfs met een watermerk in de tekst. Wij houden het erop dat dit een gelaagde verantwoordelijkheid creëert, die verder gaat dan enkel technische oplossingen.
Wat betekent dit nu?
De implementatie van watermerken door OpenAI is een noodzakelijke stap om te voldoen aan de Europese regelgeving. Het laat zien dat techgiganten hun producten aanpassen aan lokale wetgeving, zij het soms met een pragmatische aanpak om klanten niet af te schrikken. De beperkingen van de detectiesystemen, zoals de gevoeligheid voor bewerkingen en de moeilijkheid bij korte teksten, wijzen erop dat watermerken een hulpmiddel zijn, geen absolute garantie voor herkenning. Dit vraagt om een kritische blik van gebruikers en uitgevers, die naast de technische signalen ook zelf hun verantwoordelijkheid moeten nemen voor de herkomst van informatie.
