編碼專區

Unicode碼位

將一個Unicode純量值對應為U+表示法、十進位與十六進位格式。

Unicode碼位: 找出單一純量值的Unicode數值識別碼。Unicode碼位會同時顯示U+表示法、十進位與十六進位格式。您可以用它區分外觀相似的字元,或識別貼上的符號;但請記住,一個可見符號可能包含多個純量值。 全程在瀏覽器中於本機執行,檔案不會上傳至伺服器。

使用次數
在瀏覽器中
費用
免費・免註冊
可用狀態
可立即使用
Character → U+ / 本機工作台本機處理

全程在瀏覽器中執行

16字元輸入 · 一個Unicode純量結果

結果

準備就緒

代理碼位不是Unicode純量值,因此會遭拒。

螢幕上一個字元,實際上有多個碼點

看起來像一個字元的內容,可能由多個碼點組成,而這個工具一次只接受一個碼點。旗幟由兩個區域指示符號字母組成。帶膚色的讚符號由兩個碼點組成。家庭表情符號則透過零寬度連接符號串起多個人物。紅色愛心通常是 U+2764,後面接著變體選擇符 U+FE0F。若要將這類序列拆解成各個部分,請使用Unicode 檢視器。

外觀相似的字元與字串長度

相同的可見字母可能有不同的碼點。é可能是單一的 U+00E9,也可能是e後接組合重音符號 U+0301;這兩種形式在正規化(通常正規化為 NFC)前,比對結果並不相等。西里爾字母а(U+0430)看起來像拉丁字母a(U+0061),這種技巧常被用於製造外觀相似的網址。高於 U+FFFF的碼點會佔用兩個 UTF-16單元,因此 JavaScript 中"😀".length的結果是2。

使用方式

  1. 依照下方顯示的格式輸入值。
  2. 執行轉換,並依據來源慣例核對結果。
  3. 以目的地要求的格式複製或下載輸出內容。

隱私與限制

轉換會在您的瀏覽器中執行。您的值和結果不會上傳。

相關工具

常見問題

為什麼我的單一表情符號會因為超過一個字元而遭拒?

部分顯示的表情符號其實是由多個部分組成的序列,包括旗幟、膚色變體,以及使用零寬連字元串接的家庭表情符號。此欄位接受一個純量值,而不是一個視覺字素。請使用Unicode檢視器將序列分解為各個純量值,再在這裡查詢每個部分。

é和e後面接著重音符號算是相同的輸入嗎?

它們看起來可能完全相同,但前者可以是一個純量值U+00E9,後者則是U+0065後接U+0301。後一種形式會因為包含多個純量值而遭拒。查詢前不會進行正規化,因此工具會顯示您輸入的表示形式,而不是替您選擇canonical拼法。

十進位結果代表位元組值或字串長度嗎?

它是純量值的數值識別碼。以😀為例,數值是128512,但它的UTF-8表示需要四個位元組,而其JavaScript字串會佔用兩個UTF-16程式碼單元。這些量度回答的是不同問題。若要查詢位元組,請使用Text to Hex,不要把十進位識別碼當成編碼後的位元組。

免費工具・使用在瀏覽器中次・免註冊