OpenAI gaat de komende weken onzichtbare watermerken toevoegen aan tekst die ChatGPT en Codex genereren voor gebruikers in de Europese Unie. Het bedrijf noemt de techniek textGrain: een methode die de woordkeuze van het model subtiel aanpast, zodat er een statistisch patroon in de tekst ontstaat dat voor lezers niet zichtbaar is en ook niet verdwijnt wanneer de tekst wordt gekopieerd.
Ontwikkelaars die de OpenAI API gebruiken, kunnen vanaf nu wereldwijd zelf kiezen of ze watermerken inschakelen; standaard staat de functie uit. In de EU wordt watermerking de komende weken automatisch ingeschakeld voor geschikte output van ChatGPT en Codex.
Om het watermerk te herkennen is toegang tot de detectietool van OpenAI nodig. Die toegang is voorlopig beperkt tot goedgekeurde onderzoekers en gespecialiseerde organisaties.
De betrouwbaarheid van de detectie hangt sterk af van hoeveel een tekst is bewerkt. Bij vervanging van 10 procent van de woorden door synoniemen daalt de detectiekans van ongeveer 92 naar 66 procent, en bij 25 procent vervangen woorden zakt dit verder naar 17 procent. Voor kortere teksten van 200 tokens herkent het systeem het watermerk in ongeveer 80 procent van de gevallen, tegen circa 95 procent bij 400 tokens.
OpenAI benadrukt dat de afwezigheid van een watermerk niet bewijst dat een tekst door een mens is geschreven, en dat een gedetecteerd watermerk niets onthult over de gebruiker, het account, de gebruikte prompt of eventuele menselijke bewerking.
De timing hangt samen met de EU AI Act, die aanbieders verplicht om AI-gegenereerde content herkenbaar te maken. Voor Nederlandse bedrijven verandert er in de praktijk weinig: het watermerk is onzichtbaar en de detectietool is nog niet breed beschikbaar. Wie beleid maakt rond AI-herkenning op de werkvloer, doet er goed aan de ontwikkeling te volgen.
Bron: BleepingComputer
Blijf op de hoogte
Meld je aan voor de nieuwsbrief: spoedalerts bij kritieke dreigingen en een wekelijks overzicht. Geen mail achterlaten? Volg ons dan via RSS.