Enterprise & Security

textGrain: OpenAIs Text-Wasserzeichen kommt in die EU, und ein Viertel ausgetauschte Wörter macht es fast unsichtbar

3 Min. Lesezeit KI-generiert

Bei Mathematik-Antworten findet der Detektor das Zeichen viel seltener als bei Psychologie. In Formeln gibt es zu wenig Spielraum in der Wortwahl.

Featured image for "textGrain: OpenAIs Text-Wasserzeichen kommt in die EU, und ein Viertel ausgetauschte Wörter macht es fast unsichtbar"

OpenAI hat am 5. Oktober erklärt, wie es den Artikel des EU AI Acts erfüllen will, der verlangt, dass maschinell erzeugter Text maschinenlesbar erkennbar ist. Das Verfahren heißt textGrain und setzt ein unsichtbares statistisches Signal in die Wortwahl des Modells. Ein Detektor sucht nach diesem Signal.

Der Zeitplan ist in drei Schritte geteilt. Ab sofort können API-Kunden weltweit das Wasserzeichen für ausgewählte Modelle einschalten – es bleibt in der API standardmäßig aus. In den kommenden Wochen bekommen ChatGPT- und Codex-Ausgaben in der EU das Zeichen, dort ohne Opt-in. Und der Detektor wird nicht veröffentlicht: Wer ihn haben will, bewirbt sich, und OpenAI gibt ihn zunächst nur an geprüfte Forschende und Fachorganisationen.

Für Bilder und Audio bleibt alles, wie es war. openai.com/verify und die Content Provenance API sind weiter offen.

Die Zahlen, die OpenAI selbst nennt

Bei einer angestrebten Falsch-Positiv-Rate von einem Prozent findet der Detektor das Zeichen in etwa 80 Prozent der 200-Token-Passagen und in etwa 95 Prozent der 400-Token-Passagen – gemessen an Inhalten wie Psychologie. Bei Mathematik liegt die Rate deutlich darunter, weil die Wortwahl dort kaum Spielraum lässt. Je kürzer und je formelhafter der Text, desto schlechter.

Noch deutlicher wird es beim Bearbeiten. In 400-Token-Passagen sinkt die Erkennung von rund 92 auf 66 Prozent, wenn zehn Prozent der Wörter durch Synonyme ersetzt werden. Bei 25 Prozent sind es 17 Prozent.

Was das Zeichen laut OpenAI nicht leistet, steht in einem eigenen Abschnitt: Es misst keinen menschlichen Anteil, es klärt keine Urheberschaft und keine Verantwortung, und es identifiziert keine Person.

An der Qualität ändert es offenbar nichts. OpenAI zeigt für Astra auf höchster Stufe acht Benchmarks mit und ohne Wasserzeichen; die Werte liegen durchweg beieinander, bei GPQA Diamond 93,94 gegen 94,44 Prozent, bei Terminal-Bench 4.0 sogar 56,06 gegen 53,90 zugunsten der markierten Fassung.

Anthropic war im August dran

Dass das Verfahren bekannt klingt, hat einen Grund. Anthropic setzt seit August Wasserzeichen in von Claude erzeugte Texte, und wie das technisch funktioniert, habe ich damals auseinandergenommen. Dieselbe Idee, dieselbe Schwäche: Wer den Text umschreibt, entfernt das Zeichen weitgehend.

OpenAI vergleicht textGrain in eigenen Tests mit Googles SynthID für Text und sagt, man habe gleich gut oder besser abgeschnitten. Die Technik soll später als Open Source erscheinen.

Wer markiert wird, entscheidet die Postleitzahl

Zwei Sätze derselben Ankündigung stehen in einem bemerkenswerten Verhältnis. In der EU bekommt ChatGPT-Text das Zeichen, ohne dass jemand gefragt wird. In der API bleibt es überall aus, bis ein Entwickler es anschaltet – also genau dort, wo Text in großen Mengen entsteht und weiterverarbeitet wird.

Das ist nicht gegen den AI Act gerichtet, der Artikel adressiert den Anbieter gegenüber Endnutzern. Es zeigt nur, wie weit die Pflicht und das Problem auseinanderliegen. Und der Detektor, der das Ganze überhaupt prüfbar machen würde, liegt vorerst hinter einem Bewerbungsformular.

Quellen

OpenAIEU AI ActWasserzeichenRegulierungChatGPT