Onderzoekscheck
Zo weten we dit
Bekijk de methode, beperkingen en oorspronkelijke bron achter dit verhaal.
Volledige onderzoekscheck 9 onderdelen
- Onderzoeksopzet
- Officiële product- en beleidsaankondiging met door OpenAI gerapporteerde technische evaluaties; geen onafhankelijke peer-reviewed praktijktest.
- Steekproef of materiaal
- OpenAI rapporteert tests op watermerkte antwoorden, waaronder Engelse ELI5-passages van 200 en 400 tokens en bewerkingen met 10% en 25% woordvervanging.
- Vakblad of publicatie
- OpenAI
- Onderzoeksinstelling
- OpenAI; juridische context: Europese Commissie
- Financiering
- Bedrijfsontwikkeling door OpenAI.
- Belangenverklaring
- OpenAI beschrijft en beoordeelt zijn eigen watermerktechnologie.
Belangrijkste beperking
De detector is niet openbaar, de uitrol is gefaseerd en korte, sterk bewerkte, vertaalde of taalarme tekst kan het signaal verliezen of te weinig signaal bevatten.
Wat dit niet bewijst
Een positieve detectie bewijst niet wie de tekst schreef, hoeveel een mens bijdroeg, wie eigenaar is of dat de inhoud klopt. Geen detectie bewijst evenmin dat een mens de tekst schreef.
Een antwoord van ChatGPT ziet eruit als gewone tekst. Toch wil OpenAI daar in Europa binnenkort een onzichtbaar patroon aan toevoegen. In de komende weken krijgen in aanmerking komende teksten van ChatGPT en Codex in de Europese Unie een statistisch watermerk, op alle abonnementen.
Dat betekent niet dat ergens een verborgen teken, extra spatie of geheime code tussen de letters staat. OpenAI’s techniek, textGrain, beïnvloedt heel subtiel welke woorden of woorddelen het model kiest. Alleen een detector met de juiste geheime instellingen kan vervolgens zoeken naar dat patroon.
Voor gewone gebruikers zit daar meteen de belangrijkste beperking: de tekstdetector wordt voorlopig niet openbaar. Je kunt dus niet zelf een tekst invoeren om betrouwbaar te controleren of ChatGPT eraan heeft meegewerkt.
Wat verandert er precies?
OpenAI maakt onderscheid tussen zijn eigen diensten, de API en de detector:
| Onderdeel | Wat verandert? | Wanneer of voor wie? |
|---|---|---|
| ChatGPT en Codex | Onzichtbaar watermerk in in aanmerking komende tekst | Gefaseerd in de komende weken, alleen in de EU, op alle abonnementen |
| OpenAI API | Klanten kunnen watermerken aanzetten voor ondersteunde modellen | Wereldwijd beschikbaar als opt-in; standaard uit |
| Tekstdetector | Zoekt naar het geheime textGrain-patroon | Voorlopig alleen voor goedgekeurde onderzoekers en deskundige organisaties |
| Controle van beeld en audio | Bestaande verificatietools blijven beschikbaar | Publiek via OpenAI’s verificatietool en API, binnen de geldende limieten |
OpenAI noemt geen datum waarop ieder Nederlands account tegelijk omschakelt. Het bedrijf spreekt over een uitrol in de komende weken en over ‘in aanmerking komende’ tekst. Daardoor kan de dekking aanvankelijk verschillen per product, model of route waarlangs iemand het model gebruikt.
Geen onzichtbare letters, maar een kanspatroon
Een taalmodel berekent voor ieder volgend woorddeel meerdere mogelijke vervolgen. textGrain verdeelt die kansen op een geheime, gecontroleerde manier. Over een langere passage ontstaat daardoor een patroon dat vaker voorkomt dan op basis van toeval verwacht zou worden.
Kopiëren en plakken verwijdert het patroon niet, omdat het in de gekozen formulering zelf zit. Dat maakt textGrain anders dan metadata die aan een bestand kan worden gekoppeld en bij conversie verloren kan gaan.
Toch is het signaal niet onverwoestbaar. Vertalen, stevig herschrijven of veel woorden vervangen kan de detectie verzwakken. Ook korte antwoorden, code en teksten met weinig mogelijke formuleringen bevatten minder ruimte om zo’n statistisch patroon aan te brengen.
De Europese gedragscode houdt daar rekening mee. Volgens OpenAI vereist die geen tekstwatermerk bij uitvoer korter dan 200 tokens — ongeveer 150 Engelse woorden — en evenmin bij codefragmenten. Dat betekent niet dat iedere langere tekst automatisch herkenbaar is.
Hoe betrouwbaar is de detectie?
De cijfers komen uit evaluaties van OpenAI zelf, niet uit een onafhankelijke praktijktest. Bij een ingestelde fout-positiefkans van 1 procent rapporteert het bedrijf de volgende resultaten:
| Test van OpenAI | Gemelde detectie |
|---|---|
| Psychologietekst van 200 tokens | ongeveer 80% |
| Psychologietekst van 400 tokens | ongeveer 95% |
| Tekst van 400 tokens, 10% van woorden vervangen door synoniemen | van circa 92% naar 66% |
| Tekst van 400 tokens, 25% van woorden vervangen door synoniemen | 17% |
Bij wiskundige antwoorden lag de detectie volgens OpenAI duidelijk lager, omdat daar minder vrijheid in woordkeuze bestaat. De test met vervangen woorden gebruikte Engelse antwoorden uit de ELI5-dataset. De cijfers vertellen daarom niet hoe goed de detector straks bij ieder Nederlands schoolverslag, beleidsstuk of nieuwsartikel werkt.
Een fout-positiefkans van 1 procent is bovendien geen garantie voor iedere praktijksituatie. Onderwerp, lengte, taal, gebruikte modelversie en latere bewerking kunnen de uitkomst beïnvloeden.
Wat kan een watermerk wel en niet bewijzen?
Een detectieresultaat is een aanwijzing over de mogelijke rol van een ondersteund OpenAI-systeem. Het is geen digitaal auteursbewijs.
| Een gevonden watermerk kan aangeven… | Het bewijst niet… |
|---|---|
| dat een ondersteund OpenAI-systeem waarschijnlijk tekst genereerde of bewerkte | welke persoon de tekst maakte of indiende |
| dat het geheime patroon in de passage aanwezig is | hoeveel tekst door een mens is geschreven of aangepast |
| dat de tekst uit een ondersteunde product- of modelroute kan komen | wie eigenaar is of juridisch verantwoordelijk is |
| dat software een herkomstsignaal herkent | dat de inhoud feitelijk juist, veilig of eerlijk gebruikt is |
Ook de omgekeerde conclusie klopt niet: geen gevonden watermerk is geen bewijs dat een mens de tekst schreef. De tekst kan te kort, vertaald of herschreven zijn, van vóór de uitrol dateren, via een niet-ondersteund model zijn gemaakt of afkomstig zijn van een andere AI-dienst.
Kan een docent of werkgever dit straks controleren?
Niet met de officiële tekstdetector, tenzij de organisatie door OpenAI wordt toegelaten tot het beperkte onderzoeksprogramma. De openbare verificatietool van OpenAI controleert wel ondersteunde beelden en audio, maar biedt gewone bezoekers bij de start geen vergelijkbare tekstcontrole.
Dat onderscheid is belangrijk. Commerciële ‘AI-detectors’ die nu al online staan, zoeken doorgaans met een classificatiemodel naar taalpatronen. Zij beschikken niet automatisch over de geheime textGrain-sleutel. Hun score is dus iets anders dan het aantreffen van het ingebedde OpenAI-signaal.
Een school, werkgever of uitgever kan een detectoruitslag daarom niet verantwoord als enige bewijs gebruiken. OpenAI waarschuwt zelf voor zowel gemiste watermerken als fout-positieve resultaten en beperkt om die reden de toegang.
Watermerk en zichtbaar AI-label zijn niet hetzelfde
De Europese AI-verordening legt verschillende transparantieplichten naast elkaar. Aanbieders van generatieve AI moeten geschikte uitvoer machineleesbaar markeren. Voor bepaalde AI-gegenereerde teksten over onderwerpen van publiek belang kan daarnaast een zichtbare openbaarmaking nodig zijn door de organisatie die de tekst publiceert.
De officiële uitleg van de Europese Commissie zegt dat tekst die werkelijk door mensen is beoordeeld of onder redactionele controle en verantwoordelijkheid staat, voor die zichtbare meldplicht een uitzondering kan krijgen. Een oppervlakkige spellingcontrole telt niet als inhoudelijke beoordeling.
Dat verandert niets aan het automatische watermerk dat een aanbieder in de gegenereerde uitvoer kan verwerken. Het laat vooral zien waarom ‘er zit een watermerk in’ en ‘dit moet zichtbaar als AI-tekst worden gelabeld’ twee verschillende vragen zijn. Welke verplichting voor een concrete organisatie geldt, hangt af van het gebruik en vraagt zo nodig juridisch advies.
Wat merkt een gebruiker in Nederland?
Waarschijnlijk niets aan de vormgeving. De markering hoort onzichtbaar te blijven en OpenAI zegt in eigen benchmarks geen betekenisvol kwaliteitsverlies te zien. Die prestatieclaim is nog niet onafhankelijk voor dagelijks Nederlands gebruik bevestigd.
Je hoeft als gewone ChatGPT-gebruiker niets in te schakelen. Voor de API is de situatie anders: daar staat tekstwatermerken standaard uit en kiest de klant zelf voor welke ondersteunde modellen de functie wordt aangezet.
De nuttigste vuistregel blijft daarom eenvoudig: behandel een watermerk als één herkomstsignaal, niet als een oordeel over een persoon of tekst. Kijk bij belangrijke beslissingen ook naar bronnen, versiegeschiedenis, opdrachtproces, menselijke toelichting en inhoudelijke kwaliteit.
Wat is nog onbekend?
OpenAI heeft nog niet bekendgemaakt wanneer elk account wordt bereikt, wanneer de detector breder toegankelijk wordt of hoe de techniek buiten gecontroleerde tests in verschillende Nederlandse tekstsoorten presteert. Ook wil het bedrijf textGrain later als opensourcetechnologie beschikbaar maken, maar daarvoor is geen vaste datum genoemd.
De uitrol kan daardoor meer inzicht opleveren in de praktische waarde van tekstwatermerken. Voorlopig is de belangrijkste conclusie bescheidener: ChatGPT-tekst krijgt in Europa een extra technisch signaal, maar dat signaal is geen sluitend bewijs — en de meeste mensen kunnen het niet eens rechtstreeks controleren.
Bronnen
Nederlandse context
Wat betekent dit voor Nederland?
De wijziging geldt in de Europese Unie en daarmee voor in aanmerking komende ChatGPT- en Codex-uitvoer voor gebruikers in Nederland.
Transparantie
Updates en correcties
Inhoudelijke update: OpenAI kondigt een gefaseerde EU-uitrol van textGrain aan en publiceert evaluatiecijfers en beperkingen.
Zie je een fout of ontbreekt er context? Bekijk hoe we corrigeren.
