Verbinder, Selektoren und Füllzeichen
TAG CHARACTERS (U+E0000–U+E007F)
Eine Schattenkopie von ASCII. U+E0020–U+E007E spiegeln die druckbaren ASCII-Zeichen eins zu eins und zeichnen nichts. U+E007F CANCEL TAG beendet eine Sequenz.
- Bereich
U+E0000–U+E007F- Standardmäßig entfernt
- Wenn frei stehend
- Zuständige Option
- Aggressiv
-a - Kann tragend sein
- Ja
Woher es kommt
Die einzige derzeit vorgesehene Verwendung sind die Flaggen von Verwaltungseinheiten: 🏴, gefolgt von den Tag-Zeichen für „gbsct“ und einem Cancel Tag, ergibt die Flagge Schottlands. Alles andere ist Absicht – das ist der Block hinter dem ASCII-Smuggling, bei dem eine unsichtbare Anweisung an eine Eingabe oder ein Dokument angehängt wird.
Warum es zählt
Das ist die gefährlichste Familie auf dieser Liste. Eine Tag-Sequenz ist für ein menschliches Auge unsichtbar, wird unversehrt kopiert und eingefügt und von vielen Sprachmodellen als ganz gewöhnlicher Text gelesen – so kann ein harmlos wirkender Absatz eine Anweisung tragen, die niemand sieht. Wenn du fremden Text prüfst, bevor er ein Modell erreicht, ist das der Block, den du zuerst kontrollierst.
Vorher und nachher
Sechs Tag-Zeichen buchstabieren ein Wort, das niemand sehen kann. Ghostchars zeigt jedes einzelne davon mit seiner Position und seinem ASCII-Zwilling.
Das Zeichen wird als beschriftete Marke dargestellt, damit du siehst, wo es sitzt. In deinem Text zeichnet es überhaupt nichts.
Wann es berechtigt ist
Innerhalb einer vollständigen Flaggensequenz: eine schwarze Flagge als Basis, ein oder mehrere Tag-Zeichen, ein Cancel Tag. Ghostchars zerlegt die ganze Sequenz und behält genau diese; ein Tag-Zeichen, das nicht in einer gültigen Flagge steht, steht frei und wird entfernt.
So entfernst du es
Frei stehende Tag-Zeichen entfernt die Voreinstellung. Gültige Flaggensequenzen werden behalten und gemeldet; `-a` entfernt auch sie und lässt dir eine schlichte schwarze Flagge.
Ist das ein KI-Wasserzeichen?
Wird zum Verstecken von Daten benutzt – kein Wasserzeichen
Nein – und hier lohnt sich Genauigkeit. Tag-Zeichen sind kein Wasserzeichen, das ein Modell hinterlässt; sie sind eine Angriffsfläche, die AUF Modelle zielt. Eine Tag-Sequenz in Text, den du gleich in einen Assistenten einfügst, ist eine Prompt Injection, bis das Gegenteil bewiesen ist.
Ein bekannter Träger für absichtlich versteckte Nutzlasten. Jemand hat es mit Absicht dort platziert, und das ist eine andere Frage als die, wer die Wörter geschrieben hat.
Fragen
Was ist ASCII-Smuggling?
Lesbaren ASCII-Text im Tag-Block kodieren, sodass er auf dem Bildschirm unsichtbar und in der Zeichenkette trotzdem vorhanden ist. Alles, was den Rohtext liest – viele Sprachmodelle eingeschlossen –, kann danach handeln.
Zerstört es die Flagge von Schottland oder Wales?
Nein. Diese Flaggen SIND Tag-Sequenzen: eine schwarze Flagge, der Code der Verwaltungseinheit in Tag-Zeichen und ein Cancel Tag. Ghostchars prüft die ganze Sequenz und behält sie; nur `-a` entfernt sie.
Soll ich Text säubern, bevor ich ihn in eine KI einfüge?
Wenn der Text von irgendwoher stammt, das du nicht kontrollierst: ja. Unsichtbare Anweisungen im Tag-Block sind der Standardweg für indirekte Prompt Injection.
Prüf deinen eigenen Text
Füg irgendetwas in den Textreiniger ein und sieh jedes unsichtbare Zeichen darin – mit Position, Codepoint und dem, was mit jedem einzelnen passiert. Nichts wird hochgeladen.