OpenAI legt offen, wie es künftig Text kennzeichnen will, um der EU-KI-Verordnung zu genügen. Das Verfahren heißt textGrain und bleibt vorerst ein Angebot an API-Kunden. In der EU kommen die Wasserzeichen automatisch.
Was OpenAI mit textGrain vorhat
Der EU AI Act verlangt von Anbietern generativer KI, dass erzeugter Text maschinenlesbar erkennbar ist. OpenAI hat am 5. Oktober beschrieben, wie es diese Vorgabe erfüllen will. Das Verfahren dahinter heißt textGrain.
Das Prinzip ist unspektakulär, wenn man es einmal verstanden hat. textGrain fügt den Wortwahlen des Modells ein unsichtbares statistisches Signal hinzu. Ein spezieller Detektor sucht nach diesem Muster und schätzt ab, ob eine Passage aus einem OpenAI-Modell stammt. Kurz gesagt: Der Text bleibt gleich, nur die Wahrscheinlichkeiten dahinter verschieben sich. Für Sie als Leser ändert sich nichts Sichtbares.
OpenAI plant drei konkrete Schritte, gestaffelt nach Zielgruppe und Region.
Die drei Schritte des OpenAI-Plans
Die Reihenfolge ist bewusst gestaffelt, weil die Technik noch nicht ausgereift ist.
Zum Ersten können API-Kunden weltweit ab sofort die Textwasserzeichen für ausgewählte Modelle einschalten. Standardmäßig bleibt die Funktion in der API aus. Kaum jemand wird sie finden. Wer sie will, muss sie aktiv aktivieren.
Zum Zweiten will OpenAI in den kommenden Wochen den Textausgaben von ChatGPT und Codex für Nutzer in der Europäischen Union ein unsichtbares Wasserzeichen hinzufügen. In der EU wird es also nicht optional sein, sondern automatisch mitlaufen. Das gilt für qualifizierte, also passende Modelle und Ausgaben.
Zum Dritten öffnet das Unternehmen Anträge für den Zugang zum Wasserzeichen-Detektor. Die Freigabe ist zunächst auf geprüfte Forscher und Fachorganisationen beschränkt, die dabei helfen, die Verlässlichkeit des Verfahrens zu bewerten und zu verbessern, bevor es breiter eingesetzt wird.
Die bestehenden Werkzeuge für Bilder und Audio bleiben davon unberührt. Das Verifizierungstool unter openai.com/verify und die Content-Provenance-API bleiben für Organisationen offen, die prüfen möchten, ob ein Bild oder eine Audiodatei aus einem OpenAI-System stammt, und zwar unabhängig von der Textkennzeichnung.
Was textGrain laut OpenAI leistet
OpenAI vergleicht das eigene Verfahren mit Ansätzen anderer Anbieter. In den eigenen Tests habe textGrain mit anderen getesteten Methoden gleichgezogen oder diese übertroffen, darunter SynthID für Text von Google DeepMind. Der technische Bericht soll in den kommenden Wochen weitere Details erhalten, und das Unternehmen will die Technologie als Open Source bereitstellen, damit andere darauf aufbauen können.
Solche Vergleiche stammen vom Anbieter selbst und sind nicht unabhängig nachgeprüft. Wichtiger ist, was OpenAI über die Grenzen sagt. Gute Ergebnisse unter idealen Bedingungen garantieren keine verlässliche Erkennung im Alltag.
Ein Detektor kann zwei Arten von Fehlern machen. Er kann ein Wasserzeichen melden, wo keines ist, das ist ein falsch positiver Befund. Oder er übersieht ein vorhandenes Wasserzeichen, ein falsch negativer Befund. Beide Fälle zeigen, wie schwer die Aufgabe ist.
Kürzere oder stark eingeschränkte Texte sind schwerer zu erkennen. Bei einer angepeilten Falsch-Positiv-Rate von 1 Prozent erkannte der Detektor die Wasserzeichen in rund 80 Prozent der 200-Token-Passagen, gegenüber etwa 95 Prozent bei 400 Token. Deutlich schlechter fielen Texte aus, bei denen die Wortwahl wenig Spielraum lässt, etwa Mathematikaufgaben.
Bearbeiten schwächt das OpenAI-Wasserzeichen
Der zweite Schwachpunkt ist das Nachbearbeiten. Wer Text verändert, zerstört das Signal teilweise, und wer ihn komplett umschreibt, macht die Kennzeichnung ohnehin zunichte.
In einem Test mit 400-Token-Passagen senkte das Ersetzen von 10 Prozent der Wörter durch Synonyme die Erkennung von rund 92 auf 66 Prozent. Wer dagegen ein Viertel der Wörter austauschte, drückte die Quote auf 17 Prozent, und damit ist der Nachweis praktisch dahin. Übersetzen, Kürzen oder Umschreiben kann ein Wasserzeichen also unbrauchbar machen.
Genau wegen dieser Grenzen beschränkt OpenAI den Detektor-Zugang zunächst auf geprüfte Forscher und Fachorganisationen. Sie sollen die Verlässlichkeit prüfen, bevor das Verfahren breit verfügbar wird.
Textlänge beziehungsweise Bearbeitung | Erkennungsrate (Schätzung) |
|---|---|
200 Token, Psychologie | rund 80 Prozent |
400 Token, Psychologie | rund 95 Prozent |
400 Token, 10 Prozent Wörter ersetzt | rund 66 Prozent |
400 Token, 25 Prozent Wörter ersetzt | rund 17 Prozent |
Was ein Textwasserzeichen nicht sagt
Was bedeutet das für die Praxis? Ein Wasserzeichen ist ein begrenztes Signal, und OpenAI listet selbst auf, was sich daraus nicht ableiten lässt.
Es misst nicht den menschlichen Anteil an einem Text. Es kann anzeigen, dass ein OpenAI-System einen Teil einer Passage erzeugt oder verarbeitet hat, aber nicht, wie viel Urteilskraft, Bearbeitung oder Kreativität von Menschen hineingeflossen ist.
Es klärt keine Eigentums- oder Verantwortungsfragen. Es sagt nicht, wem ein Text gehört, ob seine Nutzung rechtmäßig war, ob eine Offenlegung nötig war oder wer dafür haftet. Es identifiziert auch keinen Nutzer: Eine Person, Organisation, ein Konto, ein Prompt oder eine Unterhaltung werden nicht mit dem Text verknüpft.
Und es prüft keine Richtigkeit. Ein Wasserzeichen sagt nicht, ob eine Passage wahr, irreführend oder schädlich ist, und es sagt auch nichts darüber, ob der Text im richtigen Zusammenhang steht. Umgekehrt beweist das Fehlen eines erkannten Wasserzeichens keine menschliche Urheberschaft. Text kann zu kurz, zu stark bearbeitet oder übersetzt sein, als dass die Erkennung zuverlässig greift, oder aus einem nicht unterstützten Modell stammen.
Was das Wasserzeichen anzeigt
- Ein OpenAI-System hat möglicherweise Text erzeugt
- Ein maschinenlesbares Signal ist vorhanden
- Die Erkennung wird mit längerem Text besser
Was es nicht anzeigt
- Wer den Text geschrieben oder bearbeitet hat
- Ob der Inhalt korrekt oder rechtmäßig ist
- Wer Rechte oder Verantwortung trägt
Was das für Nutzer und Entwickler bedeutet
Für normale ChatGPT-Nutzer in der EU ändert sich nichts Sichtbares. Die Wasserzeichen sind unsichtbar, und laut OpenAI sind die Unterschiede bei den Qualitätsbenchmarks des aktuellen Modells Astra vernachlässigbar.
Für Entwickler und Unternehmen, die die API nutzen, ist die wichtigere Frage die Wahlfreiheit. Die Textwasserzeichen bleiben in der API standardmäßig aus und sind opt-in. Wer sie einschaltet, muss mit den bekannten Grenzen leben: Bearbeiteter Text verliert das Signal, kurze Texte sind schwer zu erkennen. Wer die Funktion braucht, um eigene Compliance-Anforderungen zu erfüllen, kann sie jetzt aktivieren. Wer sie nicht will, muss nichts tun.
Spannend bleibt die Frage der Nachprüfbarkeit. Eine zentrale Zusage lautet, dass ein Wasserzeichen keine Nutzeridentität preisgibt. Genau dieser Punkt wird sich erst bewerten lassen, wenn unabhängige Forscher den Detektor in die Hand bekommen. Bis dahin bleibt textGrain eine frühe Technologie mit offen dokumentierten Schwächen, und OpenAI sagt das selbst deutlicher als viele Kritiker es formulieren würden.






