OpenAI will nach eigenen Angaben damit beginnen, in der Europäischen Union erzeugte Texte von ChatGPT und Codex mit einem unsichtbaren Wasserzeichen zu versehen. Damit erfüllt das Unternehmen die Transparenzpflichten des AI Act, die am 2. August in Kraft getreten sind und KI-Firmen verpflichten, generierte Inhalte so zu kennzeichnen, dass andere Systeme sie erkennen können.

Der Roll-out erfolgt "in den kommenden Wochen" für berechtigte ChatGPT- und Codex-Nutzer in allen Tarifen – aber nur in der EU. Entwickler, die OpenAIs API nutzen, können das Wasserzeichen weltweit für ausgewählte Modelle sofort aktivieren; standardmäßig ist es aus, und das Unternehmen macht die Textkennzeichnung zum Start bewusst nicht zum globalen Standard.

Die Markierung ist kein in die Ausgabe gestempeltes Symbol. Sie funktioniert, indem sie die Wortwahl des Modells subtil formt: Mit einem geheimen Schlüssel werden Vorhersagen des nächsten Wortes leicht gesteuert, sodass der fertige Text ein statistisches Muster trägt, das kein menschlicher Leser sieht, ein passender Detektor aber erkennt. Weil es in den Wörtern selbst steckt, wandert das Wasserzeichen beim Kopieren und Einfügen mit. OpenAI zufolge identifiziert es den Nutzer nicht, und bei aktiviertem Wasserzeichen wurden keine nennenswerten Leistungseinbußen gemessen.

Zusammen mit der Ankündigung veröffentlichte OpenAI einen technischen Bericht zur Methode namens textGrain, verfasst mit Forschenden der University of Pennsylvania und Yale. Er beschreibt, wie ein Schlüssel die Vorhersagen des nächsten Wortes sortiert und sich Hunderte solcher Anstöße zu einem Muster summieren, aus dem der Detektor allein anhand von Text und Schlüssel KI-erzeugte Inhalte erkennt.

OpenAI benennt die Grenzen offen. In eigenen Tests sank die Erkennungsrate von rund 92 auf 66 Prozent, wenn zehn Prozent der Wörter durch Synonyme ersetzt wurden. Bei kurzen Passagen, mathematischen Antworten und übersetztem Text ist die Erkennung noch schwieriger. Auf diese Einschränkungen führt das Unternehmen zurück, dass der Zugang zum Detektor zunächst nur genehmigten Forschenden und Expertenorganisationen offensteht. Zudem warnte OpenAI, ein fehlendes Wasserzeichen "beweise keine menschliche Urheberschaft" – der Text könnte schlicht zu kurz, zu stark bearbeitet oder das Ergebnis eines konkurrierenden Modells sein.

Der Schritt kommt rund zwei Monate, nachdem Anthropic begonnen hatte, Claudes Ausgaben weltweit zu kennzeichnen – eine Entscheidung, die bei Nutzern auf Widerstand stieß, die argumentierten, Anweisungen, Kontext und Entscheidungen stammten von ihnen, das Modell sei nur das Werkzeug. OpenAI hatte bereits zuvor ein Text-Wasserzeichen entwickelt, es aber zurückgehalten, auch aus Sorge, Nutzer könnten zu Anbietern ohne Kennzeichnung abwandern. Anthropic, Google, Meta, Microsoft und OpenAI gehören zu den Unternehmen, die den EU-Verhaltenskodex zu KI-generierten Inhalten unterzeichnet haben.