OpenAI hat offiziell die Umsetzung neuer strenger Anforderungen der Europäischen Union zur Transparenz von Systemen künstlicher Intelligenz angekündigt. Der Entwickler des beliebten Chatbots ChatGPT führt eine spezielle unsichtbare Kennzeichnungstechnologie für Textinhalte und Programmcode ein, die von Nutzern in europäischen Ländern generiert werden. Dieser Schritt ist eine Reaktion auf das Inkrafttreten wichtiger Bestimmungen des EU-KI-Gesetzes, das Technologiegiganten verpflichtet, eine maschinenlesbare Kennzeichnung generierter Materialien sicherzustellen, um massiven Geldstrafen zu entgehen.

Die textGrain-Technologie und das Prinzip der Wasserzeichen

Zur Umsetzung der neuen Anforderungen nutzten OpenAI-Ingenieure eine eigene Entwicklung namens textGrain. Dieses System integriert ein unauffälliges statistisches Signal direkt in den Wortauswahlalgorithmus des Sprachmodells, wodurch die visuelle Wahrnehmung von Text oder Code für Menschen unverändert bleibt. Nach Angaben der Entwickler liegt die Erkennungseffizienz bei großen Textfragmenten von rund 400 Token bei bis zu 95 Prozent. Bei kürzeren Nachrichten mit bis zu 200 Token sinkt dieser Wert jedoch auf etwa 80 Prozent, was bestimmte Einschränkungen bei der Schnellanalyse kurzer Antworten mit sich bringt.

Widersprüchliche Daten und Robustheit der Wasserzeichen

In der Fachwelt und in spezialisierten Technikpublikationen werden die technischen Grenzen und die reale Robustheit der implementierten Wasserzeichen aktiv diskutiert, wobei verschiedene Quellen abweichende Schätzungen liefern. Während die offizielle Basisdokumentation von OpenAI besagt, dass starkes Umformulieren oder das Ersetzen eines Viertels der Wörter durch Synonyme das Wasserzeichen erheblich schwächen und die Erkennungsgenauigkeit auf 17 Prozent senken kann, weisen unabhängige Technologieportale wie yellow.com darauf hin, dass selbst relativ leichtes manuelles Bearbeiten die Erkennungsgenauigkeit auf 66 Prozent reduzieren kann. Komplexe Bereiche wie mathematische Berechnungen bleiben zudem eine Herausforderung.

Rechtsrahmen, Fristen und massive Geldstrafen

Diese Neuerungen werden in strikter Übereinstimmung mit Artikel 50 des EU-KI-Gesetzes umgesetzt. Diese Vorschrift verpflichtet alle generativen Systeme, Inhalte wie Text, Fotos, Audio und Video mit einer speziellen "AI-Generated"-Markierung zu versehen, insbesondere bei potenziellen Deepfakes oder Nachrichteninhalten. Neue Entwickler müssen die Regeln seit August einhalten, während etablierte Marktteilnehmer wie OpenAI, Anthropic, Microsoft, Google und Meta eine Anpassungsfrist bis zum 2. Dezember erhalten haben. Bei Verstößen drohen beispiellose Finanzsanktionen: Bußgelder von bis zu 15 Millionen Euro oder bis zu 3 Prozent des weltweiten Jahresumsatzes.