ChatGPT gaat teksten voorzien van onzichtbaar AI-watermerk


Om aan Europese regelgeving te voldoen gaat OpenAI, het moederbedrijf van ChatGPT, een onzichtbaar watermerk toevoegen aan teksten van ChatGPT. Dat geldt alleen voor gebruikers in de Europese Unie. De functie heet 'textGrain', zo meldt OpenAI.
De Europese AI-verordening eist sinds begin augustus dat door AI gemaakte teksten herkenbaar zijn. Eerder voerden ook andere bedrijven AI-labels in: Chatbot Claude werkt al met watermerken en Spotify labelt AI-muziek.
Het watermerk van OpenAI, textGrain genoemd, komt ook in Codex, het programma voor programmeurs. Het watermerk is onzichtbaar, en niet te vergelijken met het merkje dat je ziet als je een bankbiljet tegen het licht houdt.
Het watermerk zit in de woorden zelf. Het taalmodel van ChatGPT kiest woorden volgens een geheim patroon. Een speciaal programma kan dat patroon in een lange tekst terugvinden. De detector is alleen beschikbaar voor goedgekeurde onderzoekers en deskundige organisaties. OpenAI wil de toegang uitbreiden zodra de resultaten verantwoord te interpreteren zijn, want die zijn nu nog niet waterdicht.
Een detector kan zich vergissen en bijvoorbeeld een watermerk melden dat er niet is, of een watermerk niet opmerken dat er wel is. Gewone gebruikers, docenten en werkgevers kunnen dus niet zomaar zien of een tekst een watermerk heeft en is geschreven met behulp van ChatGPT.
Het watermerk is moeilijker te vinden in korte teksten, zegt OpenAI, en verdwijnt deels bij bewerking. In een test van OpenAI zakte de kans op herkenning in een tekst van ongeveer 400 woordstukjes van ongeveer 92 naar 66 procent toen een mens elk tiende woord door een synoniem verving.
Het ontbreken van een watermerk bewijst bovendien niet zo veel: de tekst kan bewerkt zijn, uit een ander AI-programma komen of van ChatGPT buiten de EU. En een gevonden watermerk laat alleen zien dat een AI-model waarschijnlijk meewerkte, niet wie de tekst schreef of hoeveel aandeel AI dan precies had.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.