OpenAI will geeignete ChatGPT- und Codex-Texte in der EU in den kommenden Wochen unsichtbar markieren; API-Kunden können die Funktion für ausgewählte Modelle weltweit optional aktivieren.
OpenAI hat sein Textwasserzeichen-System textGrain vorgestellt. Es fügt ein verborgenes statistisches Signal in die Wortwahl generierter Texte ein. Bei API-Modellen bleibt die Kennzeichnung zunächst standardmäßig ausgeschaltet.
Den zugehörigen Detektor stellt OpenAI anfangs nur ausgewählten Forschenden und Fachorganisationen zur Verfügung. Er soll erkennen, ob ein untersuchter Text ein OpenAI-Wasserzeichen enthält.
Die Erkennung hat Grenzen. Nach Angaben von OpenAI kann der Detektor Markierungen übersehen und unmarkierte Texte fälschlich als markiert einstufen. Kurze Passagen und mathematische Inhalte sind besonders schwierig zu prüfen.
Auch Bearbeitungen schwächen das Signal. In OpenAIs Tests mit Texten von 400 Token sank die Erkennungsrate von etwa 92 auf 66 Prozent, wenn zehn Prozent der Wörter durch Synonyme ersetzt wurden. Bei 25 Prozent ersetzter Wörter fiel sie auf 17 Prozent.
Ein erkanntes Wasserzeichen zeigt nicht, wie viel ein Mensch zum Text beigetragen hat. Umgekehrt beweist ein fehlender Treffer nicht, dass ein Mensch den Text geschrieben hat. OpenAI plant, textGrain als Open Source verfügbar zu machen.
Quellen:
OpenAI – EU Text Provenance
OpenAI – Technischer Bericht zu textGrain