OpenAI versieht geeignete ChatGPT- und Codex-Texte in der EU künftig mit einem unsichtbaren Wasserzeichen.
Das Verfahren namens Textgrain soll in den kommenden Wochen eingeführt werden und Anforderungen des EU AI Act erfüllen. Es fügt keine versteckten Zeichen ein, sondern verändert statistisch die Wortwahl des Sprachmodells. Für API-Kunden ist die Funktion weltweit optional verfügbar.
Die Erkennung bleibt allerdings fehleranfällig. Kurze Texte und Inhalte mit wenig sprachlichem Spielraum lassen sich deutlich schlechter identifizieren. Auch nachträgliche Änderungen können das Signal stark abschwächen.
So zuverlässig erkennt OpenAI das Textgrain-Wasserzeichen
OpenAI nennt deutliche Unterschiede bei der Erkennungsrate:
- Psychologie, 200 Token: 78,5 Prozent
- Psychologie, 400 Token: 94,3 Prozent
- Mathematik, 400 Token: 60,8 Prozent
- 10 Prozent Wörter ersetzt: Erkennung sinkt von 92 auf 66 Prozent
- 25 Prozent Wörter ersetzt: Erkennung sinkt auf 17 Prozent
Die Werte gelten bei einer angestrebten Falsch-Positiv-Rate von einem Prozent. Übersetzungen, Umschreibungen oder die Kombination mit anderen Texten können die Erkennung ebenfalls erschweren. Ein fehlendes Wasserzeichen beweist deshalb nicht, dass ein Mensch den Text geschrieben hat.
Der Detektor wird zunächst nur ausgewählten Forschern und Fachorganisationen zugänglich gemacht. OpenAI plant, Textgrain später als Open Source zu veröffentlichen.
Das Wasserzeichen verrät weder den Nutzer noch dessen Prompt und sagt nichts über Urheberrecht oder Richtigkeit eines Textes aus.
Ich halte den Ansatz für nachvollziehbar, sehe den praktischen Nutzen aber noch begrenzt. Wenn bereits moderate Überarbeitungen die Erkennungsrate drastisch senken, ist Textgrain eher ein zusätzliches Herkunftssignal als ein verlässlicher KI-Detektor. Claude setzt ein ähnliches System ein.
mobiFlip bei Google bevorzugen – unsere Beiträge öfter sehen Quelle wählen ↗