ChatGPT krijgt onzichtbaar watermerk in Europese teksten
3 mins read

ChatGPT krijgt onzichtbaar watermerk in Europese teksten

Wie in de Europese Unie ChatGPT of Codex gebruikt, krijgt de komende weken tekst terug met een verborgen kenmerk. OpenAI maakte maandag bekend dat het een onzichtbaar watermerk toevoegt aan tekst die zijn modellen in de EU genereren. Volgens TechCrunch is de stap een directe reactie op de transparantieregels uit de EU AI Act.

Hoe textGrain werkt

Het systeem heet textGrain en is ontwikkeld met onderzoekers van de University of Pennsylvania en Yale. Het verandert niets zichtbaars aan de tekst. In plaats daarvan stuurt het de woordkeuze van het model licht bij, met behulp van een geheime sleutel. Over honderden van die kleine keuzes ontstaat zo een statistisch patroon dat een lezer niet ziet, maar een detector wel kan oppikken.

De cijfers die OpenAI zelf publiceert, staan in een technisch rapport. The Next Web zet ze op een rij: bij passages van 200 tokens herkent de detector ongeveer 80 procent, bij 400 tokens zo’n 95 procent. Het doel is een fout-positief percentage van 1 procent.

Handen houden een vel papier tegen het licht van een raam

Makkelijk te omzeilen

Het watermerk is kwetsbaar, en OpenAI zegt dat ook. Vervang je 10 procent van de woorden door synoniemen, dan zakt de detectie naar 66 procent. Bij een kwart vervangen woorden blijft er 17 procent over. Korte stukken, vertaalde tekst en wiskundige antwoorden zijn lastiger, omdat het model daar weinig ruimte heeft om met woorden te schuiven.

OpenAI waarschuwt ook voor de omgekeerde conclusie. Een tekst zonder watermerk is volgens het bedrijf geen bewijs dat een mens hem schreef. Ook zegt het watermerk niets over wie de gebruiker is, of de inhoud klopt of wie de eigenaar is. De detector komt niet vrij beschikbaar: alleen goedgekeurde onderzoekers en gespecialiseerde organisaties kunnen toegang aanvragen.

Alleen Europa, behalve via de API

In ChatGPT en Codex geldt het watermerk alleen voor gebruikers in de EU, op alle abonnementen. Ontwikkelaars wereldwijd kunnen het via de API sinds 5 oktober zelf aanzetten voor een aantal modellen. Daar staat het standaard uit.

De timing is geen toeval. Artikel 50 van de AI Act verplicht aanbieders van generatieve AI om hun output machineleesbaar te markeren. Volgens The Next Web moeten bestaande aanbieders uiterlijk 2 december 2026 aan die plicht voldoen. Eerder schreven we al dat die markeringsplicht overeind bleef toen Brussel andere deadlines opschoof.

OpenAI is niet de eerste. Anthropic zette in augustus al een onzichtbaar watermerk in teksten van Claude, wereldwijd en met uitzonderingen. Inmiddels circuleren er tools die dat watermerk weer verwijderen. Google DeepMind gebruikt zijn SynthID-techniek intussen zelfs voor AI-ontworpen eiwitten.

Wat betekent dit

Voor de gewone gebruiker verandert er weinig: de tekst ziet er voor het oog hetzelfde uit. Wie ChatGPT-tekst licht herschrijft, haalt het watermerk er grotendeels af. Docenten en werkgevers moeten er dus niet op rekenen dat ze AI-tekst voortaan met één klik kunnen aanwijzen. Dat probleem speelt al langer, zoals bleek toen Nieuwsuur kabinetsspeeches analyseerde die grotendeels door AI waren geschreven.

Het grotere effect zit op schaal. Nu bijna een derde van het web door AI geschreven is, helpt een herkenbaar signaal in onbewerkte tekst onderzoekers en platforms om bulkproductie te volgen. Of dat werkt, hangt af van de vraag hoeveel andere aanbieders vóór december volgen, en hoe ruim OpenAI de detector straks openstelt.