エンコーディングデスク
テキスト→16進数
テキストを大文字のUTF-8バイトに変換し、スペース区切りの見やすい16進数形式で表示します。
テキスト→16進数: テキスト文字列のUTF-8バイトを、スペース区切りの大文字の16進数ペアとして表示します。Text to Hexを使うと、スペース、改行、マルチバイト文字を確認できます。コピーしたテキストの比較やエンコード例の準備に利用できます。バイト列はテキストを表すものであり、数値の基数変換ではありません。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。
- カテゴリ
- 開発者ツール
- 実行回数
- ブラウザ内で
- コスト
- 無料 · 登録不要
- 提供状況
- すぐに使えます
完全にブラウザ内で実行します
結果
準備完了出力は、バイト間をスペースで区切った大文字のUTF-8 16進数です。テキストはローカルでエンコードされ、アップロードされることはありません。
文字ごとに必要なバイト数
UTF-8ではASCIIに1バイトを使い、それ以外の文字にはより多くのバイトを使います。éはC3 A9、€はE2 82 AC、😀はF0 9F 98 80です。そのため、255バイトに制限されたフィールドには255文字よりはるかに少ない文字しか入らない場合があり、バイト数と文字数は一致しません。各ペアの前に%を付けた同じバイト列が、URLエンコードの結果です。
見えない文字を見つける
16進数に変換すると、画面上では何もないように見える文字も明らかになります。ノーブレークスペースは20ではなくC2 A0です。ゼロ幅スペースはE2 80 8Bです。ファイルから貼り付けられたバイトオーダーマークはEF BB BFです。Windowsの改行は0Aではなく0D 0Aです。見た目が同じ2つの文字列が一致しない場合、両方を変換してバイト列を比較すると、違いをすばやく見つけられます。
使い方
- 下に表示されている形式で値を入力します。
- 変換を実行し、元の規約に照らして結果を確認します。
- 変換先で必要な形式で出力をコピーまたはダウンロードします。
プライバシーと制限事項
変換はブラウザ上で実行されます。入力した値や結果がアップロードされることはありません。
関連ツール
よくある質問
アクセント付きの1文字が複数のバイトペアになるのはなぜですか?
UTF-8では、1つのUnicodeスカラー値が1〜4バイトで表されるため、バイト数と見た目の文字数は一致しません。文字éはC3 A9になり、絵文字には4バイト必要になることがあります。合成済みの文字と、文字に結合文字を続けたものは見た目が同じでも、異なるバイト列になる場合があります。
エンコード前に改行やスペースは削除されますか?
いいえ。通常のスペースは20、タブは09、LFは0A、CRLFは0D 0Aになります。変換ツールがテキストや改行コードを正規化することはありません。ただし、ブラウザへの貼り付け時点で元の改行コードが変更されている可能性があるため、表示されるのは実際に入力されたテキストのバイトです。
この出力はUTF-16、BCD、またはリトルエンディアン整数ですか?
常にUTF-8テキストとしてエンコードされます。テキストとして入力した数字は文字のバイトになるため、42は通常の整数の16進数2AやパックBCDの42ではなく、34 32になります。数値のフィールド幅やエンディアンの設定はなく、これらのバイトペアを逆順にすると、多くのマルチバイト文字が壊れます。
無料ツール · ブラウザ内で · アカウント不要