News

Text-KI-Wasserzeichen lassen sich immer trivial entfernen

watermark synthid eu-ai-act openai anthropic regulation

Sean Goedecke analysiert in einem ausfuehrlichen Blogpost, warum Text-Wasserzeichen fuer KI-Outputs ein prinzipiell unlösbares Problem darstellen. Mit der EU AI Act, die ab August 2026 durchsetzbar wird und alle KI-Outputs als “maschinell generiert” erkennbar verlangt, steht die Branche unter Druck.

Warum Text so schwer zu markieren ist

Bilder haben Pixel-Rauschen, die man unsichtbar manipulieren kann. Text ist hochkomprimiert – jede Aenderung faellt auf. Goedecke erklaert zwei Ansaetze: Googles SynthID, das Token-Sampling mathematisch beeinflusst und so ein statistisches Muster erzeugt, und Unicode-Homoglyphen, bei denen normale Leerzeichen durch unsichtbare Unicode-Varianten ersetzt werden. Letzteres hat Claude Code bereits bei chinesischen Nutzern eingesetzt.

Trivial zu entfernen

Beide Methoden haben ein fundamentales Problem: SynthID verschwindet, sobald man den Text durch ein anderes LLM paraphrasiert. Unicode-Homoglyphen lassen sich durch einfaches Ersetzen aller Sonderzeichen entfernen. Da die EU Interoperabilitaet verlangt und Wasserzeichen-Verfahren oeffentlich gemacht werden muessen, wird das Entfernen noch einfacher.

C2PA als Loesung?

C2PA-Metadaten funktionieren fuer Dateien (Bilder, Audio, Video), aber nicht fuer Chat-Output. Goedecke fragt treffend: “What would it even look like to sign ChatGPT outputs? There’s no artifact to pass around.” Seine Prognose: Jeder Provider wird einen SynthID-Sampler vor die Inference schalten, ein Detektions-Tool anbieten, und technisch versierte Nutzer werden es trotzdem umgehen.

Original: seangoedecke.com