Ein Wasserzeichen von ChatGPT

ChatGPT erhält in der EU ein unsichtbares Text-Wasserzeichen

Andreas Becker GPT-Images-2.0
Ein Wasserzeichen von ChatGPT

OpenAI versieht geeignete Texte von ChatGPT und Codex in der EU in den kommenden Wochen mit einem unsichtbaren Wasserzeichen. Die Technik namens textGrain soll KI-Texte maschinenlesbar erkennbar machen, lässt sich durch Bearbeitungen jedoch schnell abschwächen.

EU-Nutzer erhalten das Wasserzeichen automatisch

Das Wasserzeichen kommt in der EU für geeignete Ausgaben von ChatGPT und Codex und gilt für alle Tarife. OpenAI reagiert damit auf die Transparenzregeln des EU AI Act, die Anbieter generativer KI zur maschinenlesbaren Kennzeichnung erzeugter Inhalte verpflichten.

API-Kunden können textGrain weltweit für ausgewählte Modelle einschalten. Dort bleibt die Funktion standardmäßig deaktiviert. Den zugehörigen Detektor stellt OpenAI zunächst nur zugelassenen Forschern und Fachorganisationen bereit. Sie müssen sich um den Zugang bewerben.

textGrain hinterlässt ein statistisches Signal in der Wortwahl des Modells. Der Detektor benötigt dafür den erzeugten Text und einen geheimen Schlüssel. OpenAI will die Technik später als Open Source veröffentlichen.

Anzeige

Schon kleine Änderungen schwächen die Erkennung

Bei einem angestrebten Fehlalarmanteil von einem Prozent erkannte der Detektor rund 80 Prozent der 200 Token langen Psychologie-Texte. Bei 400 Token waren es etwa 95 Prozent. Mathematische Inhalte schnitten deutlich schlechter ab, weil das Modell dort weniger Spielraum bei der Wortwahl hat.

Quelle: OpenAI

Noch größer ist der Effekt nachträglicher Änderungen. Bei 400 Token sank die Erkennungsrate von rund 92 auf 66 Prozent, wenn zehn Prozent der Wörter durch Synonyme ersetzt wurden. Nach dem Austausch eines Viertels blieben nur 17 Prozent.

Quelle: OpenAI

Ein Treffer verrät weder den Nutzer noch dessen Prompt oder Gespräch. Er belegt auch nicht, wie groß der menschliche Anteil am Text ist oder ob dessen Inhalt stimmt. Umgekehrt beweist ein fehlendes Signal keine menschliche Urheberschaft. Kurze, übersetzte oder bearbeitete KI-Texte können dem Detektor entgehen. In acht Benchmarks für Astra zeigten sich mit Wasserzeichen immerhin keine durchgehend schlechteren Ergebnisse.

Quelle: OpenAI

Von Menschen für Menschen

Jeder Artikel entsteht durch menschliche Ideen und sorgfältige Prüfung. KI unterstützt uns vor allem bei Recherche und Feinschliff. Wir freuen uns über jede Unterstützung.

Jeder Beitrag zählt – auch das Teilen.