KI-Kennzeichnung

OpenAI markiert ChatGPT-Texte in der EU mit Wasserzeichen

Die Technik textGrain verändert die Wortwahl unmerklich. Nach Überarbeitung des Textes sinkt die Erkennungsrate laut OpenAI deutlich.

OpenAI markiert ChatGPT-Texte in der EU mit Wasserzeichen

OpenAI wird Texte, die ChatGPT und Codex in der Europäischen Union erzeugen, in den kommenden Wochen mit einem unsichtbaren Wasserzeichen versehen. Das kündigte das Unternehmen am 5. Oktober an. Die Technik namens textGrain verändert die Wortwahl des Modells geringfügig und erzeugt so ein statistisches Muster, das sich später nachweisen lässt. Beim Lesen oder Kopieren ist das Wasserzeichen nicht sichtbar.

Hintergrund ist Artikel 50 der EU-KI-Verordnung, der Anbieter verpflichtet, KI-generierte Inhalte maschinenlesbar als solche zu kennzeichnen. Außerhalb der EU führt OpenAI das Wasserzeichen nicht standardmäßig ein. Entwickler können es aber ab sofort weltweit für unterstützte Modelle in der API aktivieren. Den Detektor stellt OpenAI zunächst nur zugelassenen Forschern und Fachorganisationen zur Verfügung, Anträge sind ab sofort möglich.

Erkennungsrate sinkt bei Überarbeitung

Nach Tests von OpenAI ist das Wasserzeichen gegenüber normaler Bearbeitung anfällig. Bei Textpassagen mit 400 Tokens sank die Erkennungsrate von etwa 92 auf 66 Prozent, wenn 10 Prozent der Wörter durch Synonyme ersetzt wurden. Bei 25 Prozent ersetzten Wörtern lag sie bei 17 Prozent.

Auch die Textlänge spielt eine Rolle. Bei einer Zielrate von 1 Prozent falsch-positiver Ergebnisse erkannte OpenAI das Wasserzeichen in rund 80 Prozent von Antworten auf Psychologiefragen mit 200 Tokens, bei 400 Tokens in rund 95 Prozent. Bei Mathematikfragen, bei denen das Modell weniger Spielraum in der Wortwahl hat, lag die Erkennungsrate niedriger.

„Das Fehlen eines erkannten Wasserzeichens beweist keine menschliche Urheberschaft.“

OpenAI

Mit OpenAI-Werkzeugen erzeugte Texte könnten zu kurz, bearbeitet oder übersetzt sein, um zuverlässig erkannt zu werden.

Anzeige

Keine Rückschlüsse auf Nutzer

Ein erkanntes Wasserzeichen verrät laut OpenAI nicht, wer den Text erzeugt hat, und gibt keine Auskunft über Konto, Eingabe oder Unterhaltung. Es zeigt auch nicht an, wie viel des fertigen Textes von einem Menschen geschrieben oder bearbeitet wurde. Die Qualität der Antworten von GPT-6 Astra beeinträchtigt das Wasserzeichen nach Unternehmensangaben nicht, die Ergebnisse in Benchmarks blieben weitgehend gleich.

(red)

Anzeige
Anzeige