Entwickler-Werkzeug / 17

Unicode- & Unsichtbare-Zeichen-Prüfer

Prüfe Text auf versteckte Nullbreiten-Leerzeichen, Steuerzeichen, RTL-Übersteuerungszeichen und Unicode-Codepunkte.

Unicode- & Unsichtbare-Zeichen-Prüfer: TOEA dekodiert Text in einzelne Unicode-Codepunkte, erkennt unsichtbare Zeichen (z. B. ZWSP oder NBSP) und berechnet die UTF-8-Bytefolgen. Läuft zu 100% lokal in deinem Browser, ohne Datei-Uploads zum Server.

Ausführungen
In deinem Browser
Kosten
Kostenlos · ohne Anmeldung
Verfügbarkeit
Einsatzbereit
Inspektor für Unicode & unsichtbare ZeichenLokale Verarbeitung

Läuft vollständig in deinem Browser

Text- & Zeichenübersicht

Zeichenanzahl26
Codepunkte25
UTF-8-Bytes33
Unsichtbar / Nullbreite3

Detaillierte Aufschlüsselung der Codepunkte

Pos.ZeichenCodepunktUTF-8-BytesKategorie / Name
0HU+004848Letter 'H'
1eU+006565Letter 'e'
2lU+006C6CLetter 'l'
3lU+006C6CLetter 'l'
4oU+006F6FLetter 'o'
5⚠️U+200BE2 80 8BZero Width Space[VERSTECKT]
6WU+005757Letter 'W'
7oU+006F6FLetter 'o'
8rU+007272Letter 'r'
9lU+006C6CLetter 'l'
10dU+006464Letter 'd'
11!U+002121Symbol '!'
12⚠️U+00A0C2 A0Non-Breaking Space (NBSP)[VERSTECKT]
13🚀U+1F680F0 9F 9A 80Character '🚀'
14 U+002020Space
15TU+005454Letter 'T'
16eU+006565Letter 'e'
17sU+007373Letter 's'
18tU+007474Letter 't'
19 U+002020Space
20⚠️U+200EE2 80 8ELeft-To-Right Mark[VERSTECKT]
21TU+005454Letter 'T'
22eU+006565Letter 'e'
23xU+007878Letter 'x'
24tU+007474Letter 't'

Woher unsichtbare Zeichen kommen

Die meisten gelangen durch Kopieren und Einfügen hinein. Textverarbeitungen und Webseiten fügen geschützte Leerzeichen hinzu, einige Content-Systeme Leerzeichen der Breite null und Editoren für arabische oder hebräische Texte Richtungsmarkierungen. Sie verursachen schwer erkennbare Fehler: Ein scheinbar korrekter Benutzername stimmt nicht überein, grep findet ein Wort nicht und Python lehnt Quellcode mit einem geschützten Leerzeichen ab. Verbinder der Breite null in Emojis sind legitim. Prüfe daher, zu welchem Zeichen ein Zeichen gehört, bevor du es entfernst.

Richtungsüberschreibungen

Die Rechts-nach-links-Überschreibung U+202E kehrt die Anzeige des danach folgenden Textes um. Sie wurde verwendet, um Dateinamen zu verschleiern: invoice, gefolgt von U+202E und fdp.exe, wird als invoiceexe.pdf angezeigt. 2021 zeigte derselbe Trick unter dem Namen Trojan Source, dass Quellcode anders angezeigt werden kann, als er kompiliert wird. Behandle jede Überschreibung in einem Dateinamen, Code oder einer Nachricht als verdächtig.

Nicht markierte Zeichen

Die Liste unsichtbarer Zeichen deckt die häufigsten Fälle ab. Andere Zeichen, die nichts anzeigen, darunter der weiche Trennstrich U+00AD, der Wortverbinder U+2060, die Richtungsisolate U+2066–U+2069 und Variationsselektoren wie U+FE0F, erscheinen als gewöhnliche erweiterte Zeichen. Suche in der Codepoint-Spalte nach ihnen oder vergleiche die Anzahlen: Wenn der Zeichenzähler mehr Zeichen meldet, als du sehen kannst, ist etwas darin verborgen.

So benutzt du es

  1. Tippe oder füge Text in das Eingabefeld ein.
  2. Prüfe Zeichenanzahl, UTF-8-Byte-Aufschlüsselung und Warnungen zu Nullbreiten-Leerzeichen.
  3. Kopiere die detaillierte Liste der Codepunkte.

Datenschutz & Einschränkungen

Die Analyse des Textes erfolgt vollständig im lokalen Speicher deines Browsers.

Ähnliche Tools

Häufige Fragen

Welche versteckten Zeichen werden erkannt?

Nullbreiten-Leerzeichen (U+200B), geschütztes Leerzeichen (U+00A0), BOM (U+FEFF), ZWJ/ZWNJ und Steuerzeichen.

Warum weicht die Zeichenanzahl von den Codepunkten ab?

Surrogatpaare oder Emoji-Sequenzen können aus mehreren UTF-16-Codeeinheiten oder Codepunkten bestehen.

Kostenloses Tool · läuft in deinem browser · kein Konto nötig