OpenAI versieht KI-Text mit Wasserzeichen – aber nur in der EU
OpenAI will die Transparenzbedingungen der EU-Verordnung über künstliche Intelligenz (AI Act) mit Wasserzeichen in KI-generiertem Text erfüllen. Dafür hat das Unternehmen ein eigenes Wasserzeichen namens Textgrain ausgearbeitet. Spezielle Software kann das Wasserzeichen in längeren Texten womöglich aufspüren und so anzeigen, dass der Text wahrscheinlich von einem großen Sprachmodell (LLM) stammt. Menschen soll allerdings nichts auffallen.
Anders als bei Anthropic sind Wasserzeichen bei OpenAI aber nicht Standard. Nur in der Europäischen Union wird Textgrain „in den kommenden Wochen” in ChatGPT und das Programmier-LLM Codex integriert, außerhalb der Union nicht.
Zahlende Kunden, die OpenAI-Sprachmodelle über Programmierschnittstellen (API) nutzen, werden Textgrain weltweit einsetzen können, müssen das aber zusätzlich einschalten. Das gilt laut OpenAIs Ankündigung offenbar auch für Ausgaben innerhalb der Union.
Erkennungssystem nur für Ausgewählte
Zugriff auf ein System zur Erkennung von Textgrain-Wasserzeichen erhalten zunächst nur ausgewählte Forscher und Organisationen auf Antrag. Sie sollen OpenAI dabei helfen, die Wirksamkeit des Verfahrens zu bestimmen und zu dessen Verbesserung beitragen. Eines Tages möchte OpenAI Textgrain als Open Source veröffentlichen.
Die genaue technischen Beschreibung, deren Details sich mit der Zeit auch ändern sollen, würden den Rahmen dieser Meldung sprengen. Grundsätzlich setzen solche Wasserzeichen für Text darauf, die statistische Wahrscheinlichkeit der Verwendung bestimmter Wörter zu manipulieren. Bei kurzen Texten funktioniert das schlecht bis gar nicht, bei längeren Texten steigt die Chance, Textgrain-Anzeichen zu entdecken. Es gibt auch Fehlalarme.
Außerdem hängt die Wirksamkeit von der Textart ab. OpenAI hat in seiner Ankündigung nur zwei Beispiele geliefert, die unter der Annahme berechnet wurden, dass es akzeptabel ist, wenn in einem Prozent der Fälle fälschlich unterstellt wird, dass der Text KI-generiert sei. Unter dieser Einschränkung soll die Textgrain-Erkennung KI-generierter Texte zum Thema Psychologie mit 200 Token Länge in 78,5 Prozent der Fälle anschlagen. Bei 300 Token seien es 89,7 Prozent, bei 400 Token 94,3 von Hundert.
Bei mathematischen Texten hingegen liegt die Erkennungsrate bei nur 36,5 Prozent (200 Token), 52 Prozent (300) respektive 60,8 Prozent (400 Token). Solche Texte würden weniger Flexibilität bei der Wortwahl erlauben. Auswirkungen auf die Textqualität habe Textgrain kaum, sagt OpenAI.
Verschleierung möglich
Eine Rückführung auf den jeweiligen Benutzer des LLM ist demnach nicht möglich. Ein Wasserzeichen zeigt außerdem nicht an, ob und welcher Anteil eines Textes menschengemacht ist, wer die Rechte daran hält oder dafür verantwortlich zeichnet, oder ob der Inhalt stimmt.
Und das Fehlen eines OpenAI-Wasserzeichens erlaubt den Umkehrschluss menschlicher Autorenschaft nicht. Schließlich sei möglich, dass die Erkennung nicht funktioniert oder ein LLM eines anderen Anbieters genutzt wurde. Außerdem lässt sich das Wasserzeichen verschleiern, etwa durch Übersetzung, durch Vermischung mit Text aus anderen Quellen, oder durch Austausch von Wörtern. Würden jedes zehnte Wort eines Texts mit Textgrain-Wasserzeichen durch ein Synonym ersetzt, sinke die Erkennungsrate von 92 Prozent auf nur noch 66 Prozent. Wird jedes vierte Wort ausgetauscht, falle die Erkennungsquote sogar auf 17 Prozent.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.