编码工作台

Unicode码点

将一个Unicode标量值转换为U+表示法、十进制和十六进制形式。

Unicode码点: 查找单个标量值对应的Unicode数值标识。Unicode码点会同时显示U+表示法、十进制形式和十六进制形式。你可以用它区分外观相似的字符,或识别粘贴的符号;但请记住,一个可见符号可能包含多个标量值。 完全在浏览器中本地运行,文件不会上传到服务器。

使用次数
在浏览器中
费用
免费·无需注册
可用性
可直接使用
Character → U+ / 本地工作台本地处理

完全在浏览器中运行

16个字符输入 · 一个Unicode标量结果

结果

就绪

代理码点不是Unicode标量值,因此会被拒绝。

屏幕上的一个字符,多个码点

看起来像一个字符的内容可能由多个码点组成,而此工具严格接受一个码点。一个旗帜由两个区域指示符字母组成。带肤色的竖起大拇指由两个码点组成。家庭表情符号会用零宽连接符连接多个人物。红心通常是U+2764,后面跟着变体选择符U+FE0F。要将这样的序列拆分成各个部分,请使用Unicode检查器。

相似字符和字符串长度

相同的可见字母可能对应不同的码点。é可能是单个U+00E9,也可能是e后跟组合重音符U+0301;两种形式必须先进行规范化(通常规范化为NFC)后,文本才能比较相等。西里尔字母а(U+0430)看起来像拉丁字母a(U+0061),这种技巧常用于仿冒网址。高于U+FFFF的码点会占用两个UTF-16单元,因此在JavaScript中"😀".length是2。

使用方法

  1. 按照下方显示的格式输入值。
  2. 运行转换,并根据源数据的约定检查结果。
  3. 以目标位置所需的形式复制或下载输出结果。

隐私与限制

转换过程在浏览器中运行。你的值和结果不会上传。

相关工具

常见问题

为什么我输入的单个表情符号会因为包含多个字符而被拒绝?

有些显示出来的表情符号是由多个部分组成的序列,包括旗帜、肤色变体,以及通过零宽连接符连接的家庭表情。此字段接受一个标量值,而不是一个视觉上的字素。请使用Unicode检查工具将该序列拆分为组成它的各个标量值,然后在此处分别查询。

é和e后跟重音符号算是相同的输入吗?

它们看起来可能完全相同,但前者可以是一个标量值U+00E9,后者则是U+0065后跟U+0301。后者包含多个标量值,因此会被拒绝。查询前不会执行规范化,所以该工具显示的是你输入的表示形式,而不是选择某种规范拼写。

十进制结果表示字节值还是字符串长度?

它是一个标量值的数值标识。以😀为例,其数值标识是128512,但它的UTF-8表示需要四个字节,而JavaScript字符串占用两个UTF-16代码单元。这些度量回答的是不同问题。如需查询字节,请使用“文本转十六进制”,不要把十进制标识当作已编码的字节。

免费工具·使用在浏览器中次·无需账户