Bàn mã hóa

Điểm mã Unicode

Chuyển một giá trị vô hướng Unicode sang dạng U+, thập phân và thập lục phân.

Điểm mã Unicode: Tìm mã nhận dạng số Unicode của một giá trị vô hướng duy nhất. Điểm mã Unicode hiển thị dạng U+ cùng với dạng thập phân và thập lục phân. Hãy dùng công cụ này để phân biệt các ký tự trông giống nhau hoặc xác định một ký hiệu đã dán; lưu ý rằng một ký hiệu hiển thị có thể chứa nhiều giá trị vô hướng. Chạy 100% cục bộ trong trình duyệt của bạn, không có tệp nào được tải lên máy chủ.

Lượt chạy
Trong trình duyệt của bạn
Chi phí
Miễn phí · không cần đăng ký
Trạng thái khả dụng
Sẵn sàng sử dụng
Character → U+ / môi trường làm việc cục bộXử lý cục bộ

Chạy hoàn toàn trong trình duyệt của bạn

Đầu vào 16 ký tự · một kết quả vô hướng Unicode

Kết quả

Sẵn sàng

Các điểm mã thay thế không phải là giá trị vô hướng Unicode và sẽ bị từ chối.

Ánh xạ định danh và một lần tra cứu minh họa

Gọi c là scalar đã nhập và N là điểm mã Unicode của nó. Báo cáo N ở dạng thập phân, N ở dạng thập lục phân in hoa và U+ theo sau ít nhất bốn chữ số thập lục phân. Đầu vào 😀 có N = 128512 = 1×65536 + 15×4096 + 6×256 + 0×16 + 0, cho kết quả thập lục phân 1F600. Kết quả chính xác là U+1F600\nDecimal: 128512\nHex: 0x1F600. Ký hiệu đó không được lặp lại trong đầu ra của hướng này. Thập phân và thập lục phân mô tả cùng một N thay vì các mã hóa riêng biệt. Công cụ kiểm tra Unicode giúp kiểm tra các chuỗi gồm nhiều scalar bị trường đơn scalar này từ chối.

Scalar, nửa surrogate và hiển thị

Đặc tả cốt lõi Unicode (https://www.unicode.org/versions/latest/core-spec/) phân biệt các giá trị scalar với các điểm mã surrogate UTF-16. Các giá trị U+D800–U+DFFF bị từ chối, cũng như các chuỗi chứa không hoặc nhiều scalar. U+0000 hợp lệ dù không hiển thị. Trường có giới hạn độ dài 16 điểm mã, nhưng điều đó không cho phép tra cứu một chuỗi gồm mười sáu ký tự. Mọi điểm mã được chấp nhận đều nằm tại hoặc dưới U+10FFFF và vừa chính xác trong JavaScript Number; vấn đề độ chính xác số nguyên lớn của việc chuyển đổi cơ số nói chung không phát sinh. Hình dạng glyph vẫn phụ thuộc vào phông chữ được chọn.

Cách sử dụng

  1. Nhập giá trị theo định dạng hiển thị bên dưới.
  2. Chạy bộ chuyển đổi và đối chiếu kết quả với quy ước của nguồn.
  3. Sao chép hoặc tải xuống đầu ra theo định dạng mà nơi đích yêu cầu.

Quyền riêng tư và giới hạn

Việc chuyển đổi chạy trong trình duyệt của bạn. Giá trị và kết quả của bạn không được tải lên.

Công cụ liên quan

Câu hỏi thường gặp

Tại sao một emoji duy nhất của tôi lại bị từ chối vì có nhiều hơn một ký tự?

Một số emoji hiển thị là các chuỗi, bao gồm cờ, biến thể màu da và các gia đình được nối bằng ký tự nối độ rộng bằng không. Trường này chấp nhận một giá trị vô hướng, không phải một cụm ký tự hiển thị. Hãy tách chuỗi thành các giá trị vô hướng cấu thành bằng công cụ kiểm tra Unicode, rồi tra cứu từng giá trị ở đây.

é và e đi sau là một dấu trọng âm có phải là cùng một đầu vào không?

Chúng có thể trông giống hệt nhau, nhưng dạng thứ nhất có thể là một giá trị vô hướng U+00E9, còn dạng thứ hai gồm U+0065 theo sau bởi U+0301. Dạng thứ hai bị từ chối vì có nhiều giá trị vô hướng. Không có bước chuẩn hóa nào được áp dụng trước khi tra cứu, vì vậy công cụ hiển thị biểu diễn bạn đã nhập thay vì chọn một cách viết chuẩn.

Kết quả thập phân có cho biết giá trị byte hoặc độ dài chuỗi không?

Đó là mã nhận dạng số của một giá trị vô hướng. Với 😀, mã này là 128512, trong khi biểu diễn UTF-8 cần bốn byte và chuỗi JavaScript của nó chiếm hai đơn vị mã UTF-16. Những phép đo này trả lời các câu hỏi khác nhau. Hãy dùng Văn bản sang Hex để xem byte thay vì coi mã nhận dạng thập phân là một byte đã mã hóa.

Công cụ miễn phí · trong trình duyệt của bạn lượt chạy · không cần tài khoản