Technologie & AI

ChatGPT-tekst krijgt in Europa een verborgen watermerk — waarom jij het niet kunt controleren

OpenAI gaat ChatGPT- en Codex-teksten in de EU een onzichtbaar statistisch patroon geven. De detector wordt voorlopig niet openbaar en bewerkte of korte tekst blijft lastig herkenbaar.

Mededeling Bekijk de onderzoekscheck
  1. Bron
  2. Onderzoekscheck
  3. Nederlandse context
In dit artikel
Een persoon houdt een tekstblad tegen het licht, waarbij een gekleurd vingerafdrukachtig patroon zichtbaar wordt
Beeld: AI-illustratie: Feitvast, gegenereerd met OpenAI. Conceptuele redactionele illustratie; het vingerafdrukachtige patroon is geen weergave van een werkelijk textGrain-watermerk of detectorresultaat.

Onderzoekscheck

Zo weten we dit

Mededeling

Bekijk de methode, beperkingen en oorspronkelijke bron achter dit verhaal.

Volledige onderzoekscheck 9 onderdelen
Onderzoeksopzet
Officiële product- en beleidsaankondiging met door OpenAI gerapporteerde technische evaluaties; geen onafhankelijke peer-reviewed praktijktest.
Steekproef of materiaal
OpenAI rapporteert tests op watermerkte antwoorden, waaronder Engelse ELI5-passages van 200 en 400 tokens en bewerkingen met 10% en 25% woordvervanging.
Vakblad of publicatie
OpenAI
Onderzoeksinstelling
OpenAI; juridische context: Europese Commissie
Financiering
Bedrijfsontwikkeling door OpenAI.
Belangenverklaring
OpenAI beschrijft en beoordeelt zijn eigen watermerktechnologie.

Belangrijkste beperking

De detector is niet openbaar, de uitrol is gefaseerd en korte, sterk bewerkte, vertaalde of taalarme tekst kan het signaal verliezen of te weinig signaal bevatten.

Wat dit niet bewijst

Een positieve detectie bewijst niet wie de tekst schreef, hoeveel een mens bijdroeg, wie eigenaar is of dat de inhoud klopt. Geen detectie bewijst evenmin dat een mens de tekst schreef.

Oorspronkelijke bron OpenAI — Our approach to EU text provenance rules

Een antwoord van ChatGPT ziet eruit als gewone tekst. Toch wil OpenAI daar in Europa binnenkort een onzichtbaar patroon aan toevoegen. In de komende weken krijgen in aanmerking komende teksten van ChatGPT en Codex in de Europese Unie een statistisch watermerk, op alle abonnementen.

Dat betekent niet dat ergens een verborgen teken, extra spatie of geheime code tussen de letters staat. OpenAI’s techniek, textGrain, beïnvloedt heel subtiel welke woorden of woorddelen het model kiest. Alleen een detector met de juiste geheime instellingen kan vervolgens zoeken naar dat patroon.

Voor gewone gebruikers zit daar meteen de belangrijkste beperking: de tekstdetector wordt voorlopig niet openbaar. Je kunt dus niet zelf een tekst invoeren om betrouwbaar te controleren of ChatGPT eraan heeft meegewerkt.

Wat verandert er precies?

OpenAI maakt onderscheid tussen zijn eigen diensten, de API en de detector:

OnderdeelWat verandert?Wanneer of voor wie?
ChatGPT en CodexOnzichtbaar watermerk in in aanmerking komende tekstGefaseerd in de komende weken, alleen in de EU, op alle abonnementen
OpenAI APIKlanten kunnen watermerken aanzetten voor ondersteunde modellenWereldwijd beschikbaar als opt-in; standaard uit
TekstdetectorZoekt naar het geheime textGrain-patroonVoorlopig alleen voor goedgekeurde onderzoekers en deskundige organisaties
Controle van beeld en audioBestaande verificatietools blijven beschikbaarPubliek via OpenAI’s verificatietool en API, binnen de geldende limieten

OpenAI noemt geen datum waarop ieder Nederlands account tegelijk omschakelt. Het bedrijf spreekt over een uitrol in de komende weken en over ‘in aanmerking komende’ tekst. Daardoor kan de dekking aanvankelijk verschillen per product, model of route waarlangs iemand het model gebruikt.

Geen onzichtbare letters, maar een kanspatroon

Een taalmodel berekent voor ieder volgend woorddeel meerdere mogelijke vervolgen. textGrain verdeelt die kansen op een geheime, gecontroleerde manier. Over een langere passage ontstaat daardoor een patroon dat vaker voorkomt dan op basis van toeval verwacht zou worden.

Kopiëren en plakken verwijdert het patroon niet, omdat het in de gekozen formulering zelf zit. Dat maakt textGrain anders dan metadata die aan een bestand kan worden gekoppeld en bij conversie verloren kan gaan.

Toch is het signaal niet onverwoestbaar. Vertalen, stevig herschrijven of veel woorden vervangen kan de detectie verzwakken. Ook korte antwoorden, code en teksten met weinig mogelijke formuleringen bevatten minder ruimte om zo’n statistisch patroon aan te brengen.

De Europese gedragscode houdt daar rekening mee. Volgens OpenAI vereist die geen tekstwatermerk bij uitvoer korter dan 200 tokens — ongeveer 150 Engelse woorden — en evenmin bij codefragmenten. Dat betekent niet dat iedere langere tekst automatisch herkenbaar is.

Hoe betrouwbaar is de detectie?

De cijfers komen uit evaluaties van OpenAI zelf, niet uit een onafhankelijke praktijktest. Bij een ingestelde fout-positiefkans van 1 procent rapporteert het bedrijf de volgende resultaten:

Test van OpenAIGemelde detectie
Psychologietekst van 200 tokensongeveer 80%
Psychologietekst van 400 tokensongeveer 95%
Tekst van 400 tokens, 10% van woorden vervangen door synoniemenvan circa 92% naar 66%
Tekst van 400 tokens, 25% van woorden vervangen door synoniemen17%

Bij wiskundige antwoorden lag de detectie volgens OpenAI duidelijk lager, omdat daar minder vrijheid in woordkeuze bestaat. De test met vervangen woorden gebruikte Engelse antwoorden uit de ELI5-dataset. De cijfers vertellen daarom niet hoe goed de detector straks bij ieder Nederlands schoolverslag, beleidsstuk of nieuwsartikel werkt.

Een fout-positiefkans van 1 procent is bovendien geen garantie voor iedere praktijksituatie. Onderwerp, lengte, taal, gebruikte modelversie en latere bewerking kunnen de uitkomst beïnvloeden.

Wat kan een watermerk wel en niet bewijzen?

Een detectieresultaat is een aanwijzing over de mogelijke rol van een ondersteund OpenAI-systeem. Het is geen digitaal auteursbewijs.

Een gevonden watermerk kan aangeven…Het bewijst niet…
dat een ondersteund OpenAI-systeem waarschijnlijk tekst genereerde of bewerktewelke persoon de tekst maakte of indiende
dat het geheime patroon in de passage aanwezig ishoeveel tekst door een mens is geschreven of aangepast
dat de tekst uit een ondersteunde product- of modelroute kan komenwie eigenaar is of juridisch verantwoordelijk is
dat software een herkomstsignaal herkentdat de inhoud feitelijk juist, veilig of eerlijk gebruikt is

Ook de omgekeerde conclusie klopt niet: geen gevonden watermerk is geen bewijs dat een mens de tekst schreef. De tekst kan te kort, vertaald of herschreven zijn, van vóór de uitrol dateren, via een niet-ondersteund model zijn gemaakt of afkomstig zijn van een andere AI-dienst.

Kan een docent of werkgever dit straks controleren?

Niet met de officiële tekstdetector, tenzij de organisatie door OpenAI wordt toegelaten tot het beperkte onderzoeksprogramma. De openbare verificatietool van OpenAI controleert wel ondersteunde beelden en audio, maar biedt gewone bezoekers bij de start geen vergelijkbare tekstcontrole.

Dat onderscheid is belangrijk. Commerciële ‘AI-detectors’ die nu al online staan, zoeken doorgaans met een classificatiemodel naar taalpatronen. Zij beschikken niet automatisch over de geheime textGrain-sleutel. Hun score is dus iets anders dan het aantreffen van het ingebedde OpenAI-signaal.

Een school, werkgever of uitgever kan een detectoruitslag daarom niet verantwoord als enige bewijs gebruiken. OpenAI waarschuwt zelf voor zowel gemiste watermerken als fout-positieve resultaten en beperkt om die reden de toegang.

Watermerk en zichtbaar AI-label zijn niet hetzelfde

De Europese AI-verordening legt verschillende transparantieplichten naast elkaar. Aanbieders van generatieve AI moeten geschikte uitvoer machineleesbaar markeren. Voor bepaalde AI-gegenereerde teksten over onderwerpen van publiek belang kan daarnaast een zichtbare openbaarmaking nodig zijn door de organisatie die de tekst publiceert.

De officiële uitleg van de Europese Commissie zegt dat tekst die werkelijk door mensen is beoordeeld of onder redactionele controle en verantwoordelijkheid staat, voor die zichtbare meldplicht een uitzondering kan krijgen. Een oppervlakkige spellingcontrole telt niet als inhoudelijke beoordeling.

Dat verandert niets aan het automatische watermerk dat een aanbieder in de gegenereerde uitvoer kan verwerken. Het laat vooral zien waarom ‘er zit een watermerk in’ en ‘dit moet zichtbaar als AI-tekst worden gelabeld’ twee verschillende vragen zijn. Welke verplichting voor een concrete organisatie geldt, hangt af van het gebruik en vraagt zo nodig juridisch advies.

Wat merkt een gebruiker in Nederland?

Waarschijnlijk niets aan de vormgeving. De markering hoort onzichtbaar te blijven en OpenAI zegt in eigen benchmarks geen betekenisvol kwaliteitsverlies te zien. Die prestatieclaim is nog niet onafhankelijk voor dagelijks Nederlands gebruik bevestigd.

Je hoeft als gewone ChatGPT-gebruiker niets in te schakelen. Voor de API is de situatie anders: daar staat tekstwatermerken standaard uit en kiest de klant zelf voor welke ondersteunde modellen de functie wordt aangezet.

De nuttigste vuistregel blijft daarom eenvoudig: behandel een watermerk als één herkomstsignaal, niet als een oordeel over een persoon of tekst. Kijk bij belangrijke beslissingen ook naar bronnen, versiegeschiedenis, opdrachtproces, menselijke toelichting en inhoudelijke kwaliteit.

Wat is nog onbekend?

OpenAI heeft nog niet bekendgemaakt wanneer elk account wordt bereikt, wanneer de detector breder toegankelijk wordt of hoe de techniek buiten gecontroleerde tests in verschillende Nederlandse tekstsoorten presteert. Ook wil het bedrijf textGrain later als opensourcetechnologie beschikbaar maken, maar daarvoor is geen vaste datum genoemd.

De uitrol kan daardoor meer inzicht opleveren in de praktische waarde van tekstwatermerken. Voorlopig is de belangrijkste conclusie bescheidener: ChatGPT-tekst krijgt in Europa een extra technisch signaal, maar dat signaal is geen sluitend bewijs — en de meeste mensen kunnen het niet eens rechtstreeks controleren.

Bronnen

Nederlandse context

Wat betekent dit voor Nederland?

De wijziging geldt in de Europese Unie en daarmee voor in aanmerking komende ChatGPT- en Codex-uitvoer voor gebruikers in Nederland.

Transparantie

Updates en correcties

Inhoudelijke update: OpenAI kondigt een gefaseerde EU-uitrol van textGrain aan en publiceert evaluatiecijfers en beperkingen.

Zie je een fout of ontbreekt er context? Bekijk hoe we corrigeren.