Kodierungsbereich

Text zu Hex

Kodiere Text als großgeschriebene UTF-8-Bytes in einem übersichtlichen, durch Leerzeichen getrennten Hexadezimalformat.

Text zu Hex: Zeigt die UTF-8-Bytes eines Textstrings als durch Leerzeichen getrennte, großgeschriebene Hexadezimalpaare an. Text zu Hex macht Leerzeichen, Zeilenenden und Multibyte-Zeichen sichtbar. Verwende das Tool, um kopierten Text zu vergleichen oder ein Kodierungsbeispiel vorzubereiten. Die Bytefolge stellt Text dar, keine numerische Basiskonvertierung. Läuft zu 100% lokal in deinem Browser, ohne Datei-Uploads zum Server.

Ausführungen
In deinem Browser
Kosten
Kostenlos · ohne Anmeldung
Verfügbarkeit
Einsatzbereit
Text → Hex / lokale WerkbankLokale Verarbeitung

Läuft vollständig in deinem Browser

100,000 Zeichen Eingabe · 400,000 Zeichen Ausgabe

Ergebnis

Bereit

Die Ausgabe ist großgeschriebenes UTF-8-Hex mit Leerzeichen zwischen den Bytes. Der Text wird lokal kodiert und nie hochgeladen.

Wie viele Bytes jedes Zeichen benötigt

UTF-8 verwendet für ASCII ein Byte und für alle anderen Zeichen mehr: é ist C3 A9, € ist E2 82 AC und 😀 ist F0 9F 98 80. Deshalb kann ein auf 255 Bytes begrenztes Feld weit weniger als 255 Zeichen enthalten und deshalb unterscheiden sich Byte- und Zeichenzahl. Dieselben Bytes mit einem % vor jedem Paar erzeugt die URL-Kodierung.

Unsichtbare Zeichen finden

Hexadezimal macht Zeichen sichtbar, die auf dem Bildschirm nach nichts aussehen. Ein geschütztes Leerzeichen ist C2 A0 statt 20. Ein Leerzeichen mit null Breite ist E2 80 8B. Eine aus einer Datei eingefügte Byte-Reihenfolge-Markierung ist EF BB BF. Ein Windows-Zeilenumbruch ist 0D 0A statt 0A. Wenn zwei scheinbar identische Zeichenfolgen beim Vergleich nicht gleich sind, findest du den Unterschied schnell, indem du beide umwandelst und die Bytes vergleichst.

So benutzt du es

  1. Gib den Wert im unten gezeigten Format ein.
  2. Führe die Konvertierung durch und vergleiche das Ergebnis mit der Konvention deiner Quelle.
  3. Kopiere die Ausgabe oder lade sie im für dein Ziel erforderlichen Format herunter.

Datenschutz & Einschränkungen

Die Konvertierung läuft in deinem Browser. Deine Werte und Ergebnisse werden nicht hochgeladen.

Ähnliche Tools

Häufige Fragen

Warum erzeugt ein einzelner Buchstabe mit Akzent mehrere Bytepaare?

UTF-8 verwendet pro Unicode-Skalarwert ein bis vier Bytes. Deshalb unterscheiden sich die Anzahl der Bytes und die Anzahl der sichtbaren Buchstaben. Der Buchstabe é ergibt C3 A9, und ein Emoji kann vier Bytes benötigen. Ein zusammengesetzter Buchstabe und ein Buchstabe gefolgt von einem kombinierenden Zeichen können gleich aussehen, aber unterschiedliche Bytefolgen ergeben.

Werden Zeilenumbrüche und Leerzeichen vor der Kodierung entfernt?

Nein. Ein gewöhnliches Leerzeichen wird zu 20, ein Tabulator zu 09, LF zu 0A und CRLF zu 0D 0A. Der Konverter normalisiert weder den Text noch seine Zeilenenden. Beim Einfügen im Browser können sich die Zeilenenden der Quelle bereits geändert haben. Daher zeigt die Ausgabe die Bytes des tatsächlich eingegebenen Textes.

Gibt diese Ausgabe UTF-16, BCD oder Little-Endian-Ganzzahlen aus?

Der Text wird immer als UTF-8 kodiert. Als Text eingegebene Ziffern werden zu Zeichen-Bytes: 42 ergibt 34 32, nicht das gewöhnliche Integer-Hex 2A oder gepacktes BCD 42. Es gibt keine Einstellung für numerische Feldbreite oder Endianness. Das Umkehren dieser Bytepaare würde viele Multibyte-Zeichen beschädigen.

Kostenloses Tool · läuft in deinem browser · kein Konto nötig