OpenAI setzt textGrain-Wasserzeichen für ChatGPT in der EU ein
OpenAI führt unsichtbare Textwasserzeichen für ChatGPT und Codex in der Europäischen Union ein, um die Anforderungen des EU AI Act zu erfüllen. Dabei kommt eine Methode namens textGrain zum Einsatz.
Automatisch aus dem englischen Original übersetzt.
OpenAI hat begonnen, ein unsichtbares Wasserzeichensystem für Texte einzuführen, die von seinen Modellen ChatGPT und Codex generiert werden, und zwar innerhalb der Europäischen Union. Diese am Montag angekündigte Maßnahme zielt darauf ab, die Unternehmensaktivitäten mit den Transparenzanforderungen des EU AI Act in Einklang zu bringen, der am 2. August in Kraft trat. Die Einführung wird in den kommenden Wochen alle berechtigten Nutzer aller Abonnementpläne in der Region betreffen.
Was passiert ist
Der Haupttreiber dieser Änderung ist die regulatorische Compliance. Der EU AI Act verpflichtet Anbieter von KI-Modellen für allgemeine Zwecke dazu, ihre Ausgaben in einem maschinenlesbaren Format zu kennzeichnen, damit andere Systeme KI-generierte Inhalte identifizieren können. OpenAI erklärte, dass diese Funktion zum Start nicht global als Standard aktiviert werde, was auf die unterschiedlichen regulatorischen Landschaften außerhalb Europas zurückzuführen sei. Entwickler, die die OpenAI API weltweit nutzen, können das Wasserzeichen jedoch nun für ausgewählte Modelle aktivieren, obwohl es standardmäßig deaktiviert bleibt.
Diese Entscheidung folgt einer ähnlichen Ankündigung von Anthropic vor zwei Monaten, die weltweite Wasserzeichen für sein Modell Claude eingeführt hatte. Dieser Schritt löste unter Nutzern eine Debatte aus, da sie befürchteten, ihr kreativer Input würde fälschlicherweise der KI zugeschrieben. OpenAI hatte zuvor bereits Wasserzeichen-Technologie entwickelt, deren Veröffentlichung aber verzögert, angeblich aus Sorge, Nutzer könnten zu Wettbewerbern abwandern, die solche Markierungen nicht vorsehen. Nun hat sich OpenAI neben Anthropic, Google, Meta und Microsoft dem Kodex der EU für Praktiken im Umgang mit KI-generierten Inhalten angeschlossen.
Wie es funktioniert
Die Wasserzeichen-Technik, die in einem technischen Bericht gemeinsam mit Forschern der University of Pennsylvania und Yale beschrieben wird, heißt textGrain. Sie fügt dem Dokument keine sichtbaren Symbole oder Metadaten hinzu. Stattdessen beeinflusst sie subtil die Wortauswahl des Modells während der Generierung. Durch die Verwendung eines geheimen Schlüssels zur Sortierung der Vorhersagen für das nächste Wort trifft das Modell spezifische, statistisch nachweisbare Entscheidungen, die ein Muster bilden, das für menschliche Leser unsichtbar ist.
Da das Wasserzeichen in die linguistische Struktur des Textes selbst eingebettet ist, bleibt es auch beim Kopieren und Einfügen des Inhalts erhalten. Ein Detektor kann den KI-Ursprung anhand nur des Textes und des entsprechenden geheimen Schlüssels identifizieren. OpenAI berichtete, dass die Aktivierung von textGrain zu keiner wesentlichen Verschlechterung der Modellleistung oder der Ausgabequalität führte. Das System identifiziert nicht den spezifischen Nutzer, der den Text generiert hat, und wahrt so die Anonymität, während es das Quellmodell markiert.
Wichtige Details
- Das Wasserzeichen wird in den kommenden Wochen für ChatGPT- und Codex-Nutzer in der EU eingeführt.
- API-Entwickler weltweit können die Funktion für ausgewählte Modelle ab heute aktivieren, sie ist jedoch standardmäßig deaktiviert.
- Die Methode namens textGrain nutzt einen geheimen Schlüssel, um Wortauswahlen zu formen, ohne die Lesbarkeit zu beeinträchtigen.
- Die Erkennungsraten sinken bei Bearbeitungen erheblich; der Austausch von 10 % der Wörter durch Synonyme reduzierte die Erkennungsrate von 92 % auf 66 %.
- Kurze Passagen, mathematische Antworten und übersetzte Texte sind für den Detektor derzeit schwerer zu identifizieren.
- Der Zugang zum Detektor-Tool ist zunächst auf zugelassene Forscher und Expertenorganisationen beschränkt.
Warum das wichtig ist
Für Engineering-Teams, die Produkte entwickeln, die große Sprachmodelle integrieren, bringt diese Verschiebung neue Überlegungen hinsichtlich der Herkunftsnachweise von Inhalten (Content Provenance) und der Compliance mit sich. Wenn Ihre Anwendung Nutzer in der EU bedient, müssen Sie berücksichtigen, dass ausgehender Text diese statistischen Marker tragen kann. Obwohl das Wasserzeichen die Leistung nicht beeinträchtigt, verändert es die Natur der Rohausgabe. Entwickler müssen verstehen, dass der Text nicht mehr „neutral“ ist, sondern eine Signatur trägt, die von Drittanbieter-Tools verifiziert werden kann.
Darüber hinaus verdeutlichen die Einschränkungen von textGrain die Fragilität aktueller Attributions-Technologien. Die Tatsache, dass geringfügige Bearbeitungen die Erkennungsgenauigkeit erheblich reduzieren können, bedeutet, dass Wasserzeichen keinen definitiven Nachweis der Urheberschaft oder deren Fehlen liefern können. Das Fehlen eines Wasserzeichens beweist nicht, dass ein Mensch den Text erstellt hat, da der Text zu kurz, stark bearbeitet oder von einem nicht wasserzeichenversehenen Modell generiert worden sein könnte. Diese Nuance ist entscheidend für Teams, die Moderations- oder Verifikations-Pipelines entwerfen, da die alleinige Abhängigkeit von der Wasserzeichen-Erkennung zu falsch-negativen Ergebnissen führen kann.
Was Sie tun können
- Prüfen Sie Ihre Datenverarbeitungspipelines, um festzustellen, ob die Speicherung von KI-generiertem Text Aktualisierungen für die EU-Compliance erfordert.
- Testen Sie die API-Funktion, um zu sehen, wie sie sich auf Ihre spezifischen Use Cases auswirkt.



