KI-Ausgaben enthalten häufig unsichtbare Unicode-Zeichen – am häufigsten geschützte Leerzeichen und schmale geschützte Leerzeichen. Das sind jedoch alltägliche Nebenprodukte der Textformatierung, kein verstecktes Wasserzeichen. Echte Text-Wasserzeichen existieren und funktionieren, indem sie die Wortwahl statistisch beeinflussen – ohne besondere Zeichen, die man finden könnte. Du kannst jeden Text in wenigen Sekunden selbst prüfen.
Die Behauptung – und warum sie sich verbreitet hat
Alle paar Monate geht ein Beitrag viral, der zeigt, dass aus ChatGPT kopierter Text versteckte Zeichen enthält – mit dem Schluss, OpenAI versehe die Ausgaben heimlich mit einem Wasserzeichen, um sie nachverfolgen zu können.
Die Beobachtung stimmt. Die Schlussfolgerung ist nicht belegt.
Was die Leute finden, ist echt: Füge eine Chat-Antwort in einen Zeichen-Inspektor ein, und du wirst häufig Codepunkte sehen, die als nichts dargestellt werden. Der Sprung passiert bei der Interpretation. Ein Wasserzeichen muss Bearbeitungen überstehen, schwer zu entfernen sein und etwas kodieren. Zeichen, die bei der ersten Suchen-und-Ersetzen-Aktion verschwinden und keine auslesbare Nutzlast tragen, erfüllen keine dieser Bedingungen.
Was tatsächlich im Text steckt
Die unsichtbaren Zeichen, die in KI-Ausgaben auftauchen, sind überwiegend ganz gewöhnliche typografische Zeichen:
| Zeichen | Codepunkt | Warum es erscheint |
|---|---|---|
| Geschütztes Leerzeichen | U+00A0 | Hält Zahl und Einheit in einer Zeile |
| Schmales geschütztes Leerzeichen | U+202F | Schmaler Abstand vor Satzzeichen und in Zahlen |
| Nullbreiten-Leerzeichen | U+200B | Hinweise für Zeilenumbrüche, oft aus Webtexten übernommen |
| Weicher Trennstrich | U+00AD | Markiert, wo ein Wort beim Umbruch getrennt werden darf |
| Byte-Reihenfolge-Markierung | U+FEFF | Kodierungsartefakt aus einer vorgelagerten Datei |
Jedes dieser Zeichen hat einen legitimen typografischen Zweck und ist Jahrzehnte älter als Sprachmodelle. Sie gelangen auf denselben Wegen wie immer in den Text: Das Modell hat sie aus Trainingstexten gelernt, die sie enthielten, die Chat-Oberfläche rendert formatierte Ausgaben als HTML, und das Kopieren aus einer gerenderten Webseite übernimmt, was immer im Markup steckte.
Der letzte Weg ist wichtiger, als viele denken. Vieles, was dem Modell zugeschrieben wird, entsteht tatsächlich durch das Kopieren im Browser, nicht durch die Generierung. Dieselbe Antwort über die API abzurufen liefert häufig saubereren Text als das Kopieren aus dem Chat-Fenster.
Existieren Wasserzeichen für KI-Text überhaupt?
Ja – aber sie funktionieren nicht so, wie die viralen Beiträge annehmen.
Der am besten dokumentierte Ansatz ist SynthID-Text von Google DeepMind, 2024 in Nature veröffentlicht. Dabei wird subtil beeinflusst, welche Wörter das Modell in jedem Schritt wählt, sodass der fertige Text eine statistische Signatur trägt, die ein passendes Prüfverfahren erkennt. Besondere Zeichen sind daran nicht beteiligt. Nichts wird eingefügt. Das Wasserzeichen liegt in der Wahl ganz gewöhnlicher Wörter – deshalb übersteht es Kopieren und leichte Bearbeitungen, und deshalb kannst du es nicht durch die Untersuchung von Codepunkten finden.
OpenAI hat öffentlich über die Erforschung von Text-Wasserzeichen gesprochen, aber bislang keine bestätigte Implementierung für ChatGPT-Ausgaben veröffentlicht.
Die praktische Konsequenz widerspricht der Panik: Wenn ein Modell, das du nutzt, ein Wasserzeichen trägt, lässt es sich durch das Entfernen unsichtbarer Zeichen nicht beseitigen. Und wenn du unsichtbare Zeichen findest, ist das kein Beleg für ein Wasserzeichen – sondern für Formatierung.
Warum unsichtbare Zeichen trotzdem ein Problem sind
Wasserzeichen hin oder her – meist willst du sie loswerden, weil sie still Dinge kaputt machen:
- Suche und Suchen-und-Ersetzen schlagen fehl. Ein Nullbreiten-Leerzeichen zwischen zwei Buchstaben führt dazu, dass die Suche nach dem Wort nichts findet – ohne sichtbaren Grund.
- Formularvalidierung lehnt Eingaben ab. Eine E-Mail-Adresse oder ein Lizenzschlüssel mit einem geschützten Leerzeichen am Ende scheitert an einem Vergleich, der auf dem Bildschirm korrekt aussieht.
- Code lässt sich nicht kompilieren oder parsen. Ein geschütztes Leerzeichen dort, wo ein normales hingehört, erzeugt einen Syntaxfehler in einer Zeile, die völlig in Ordnung aussieht.
- CSV-Importe werden beschädigt. Eine Byte-Reihenfolge-Markierung hängt an der ersten Spaltenüberschrift, sodass das erste Feld still nicht zugeordnet wird.
- Doppelte Datensätze entstehen. Zwei identisch aussehende Einträge sind unterschiedliche Zeichenketten, sodass die Deduplizierung sie übersieht.
Diese Fehler sind besonders ärgerlich, weil der Text korrekt aussieht. Jeder Debugging-Instinkt führt in die falsche Richtung.
So prüfst und bereinigst du deinen eigenen Text
Füge den Text in den Scanner für unsichtbare Zeichen ein. Er meldet jedes Nullbreiten-Leerzeichen, jeden weichen Trennstrich, jede Byte-Reihenfolge-Markierung und jede Richtungsmarke mit einer Zählung pro Typ und entfernt sie auf Wunsch. Nichts verlässt deinen Browser – die Prüfung läuft lokal.
Wenn du das Gesamtbild willst: Der KI-Text-Bereiniger erfasst unsichtbare Zeichen zusammen mit Gedankenstrichen, typografischen Anführungszeichen und Emojis in einem Durchgang.
Eine lohnende Gewohnheit: Führe die Prüfung immer dann durch, wenn Text eine Systemgrenze überschreitet. Chat-Fenster in den Code-Editor, Webseite in die Tabellenkalkulation, PDF ins Formular. Genau dort richten unsichtbare Zeichen Schaden an – und genau da lassen sie sich am günstigsten entfernen.
Die vollständige Liste dieser Zeichen und ihrer Funktionen findest du in der Referenz zu unsichtbaren Unicode-Zeichen.
Häufige Fragen
Versieht ChatGPT seinen Text mit unsichtbaren Zeichen als Wasserzeichen?
Dafür gibt es keine Belege. Die in ChatGPT-Ausgaben gefundenen unsichtbaren Zeichen sind gewöhnliche typografische Zeichen wie geschützte und schmale geschützte Leerzeichen, die es seit Jahrzehnten gibt und die keine Nutzlast tragen. Außerdem verschwinden sie bei jeder einfachen Bereinigung – als Wasserzeichen wären sie damit nutzlos.
Kann KI-generierter Text überhaupt mit einem Wasserzeichen versehen werden?
Ja. SynthID-Text von Google DeepMind, 2024 in Nature veröffentlicht, beeinflusst die Wortwahl des Modells so, dass die Ausgabe eine statistische Signatur trägt. Dabei werden keine besonderen Zeichen eingefügt – die Untersuchung von Codepunkten kann das Wasserzeichen also nie aufdecken, und das Entfernen unsichtbarer Zeichen beseitigt es nicht.
Warum enthält aus ChatGPT kopierter Text versteckte Zeichen?
Meist, weil du gerendertes HTML von einer Webseite kopierst. Die Chat-Oberfläche zeigt formatierte Ausgaben an, und das Kopieren übernimmt die Abstandszeichen dieser Formatierung. Dieselbe Antwort über die API abzurufen liefert oft spürbar saubereren Text.
Wie finde ich unsichtbare Zeichen in meinem Text?
Füge ihn in einen Scanner ein, der Codepunkte auflistet – etwa unseren Scanner für unsichtbare Zeichen. Er identifiziert jeden vorhandenen Typ unsichtbarer Zeichen, zählt sie und entfernt sie auf Wunsch, vollständig in deinem Browser.
Sind unsichtbare Zeichen gefährlich?
Nicht gefährlich, aber durchaus störend. Sie lassen die Suche fehlschlagen, bringen Formularvalidierungen zum Scheitern, erzeugen Syntaxfehler im Code, beschädigen CSV-Überschriften und erzeugen doppelte Datensätze, die identisch aussehen. Weil der Text normal erscheint, sind diese Fehler ungewöhnlich schwer zu diagnostizieren.