인코딩 데스크
Unicode 코드 포인트
Unicode 스칼라 값 하나를 U+ 표기, 10진수, 16진수 형식으로 변환합니다.
Unicode 코드 포인트: 단일 스칼라 값의 숫자 Unicode 식별자를 확인합니다. Unicode 코드 포인트는 U+ 표기와 함께 10진수 및 16진수 형식을 표시합니다. 비슷하게 보이는 문자를 구분하거나 붙여넣은 기호를 식별할 때 사용하십시오. 단, 눈에 보이는 기호 하나가 여러 스칼라로 구성될 수 있다는 점에 유의하십시오. 서버에 파일을 전혀 업로드하지 않고 브라우저에서 100% 로컬로 실행됩니다.
- 카테고리
- 개발자 도구
- 실행 횟수
- 브라우저에서
- 비용
- 무료 · 가입 불필요
- 사용 가능 여부
- 사용 가능
브라우저에서 전부 실행됩니다
결과
준비됨서로게이트 코드 포인트는 Unicode 스칼라 값이 아니므로 거부됩니다.
동일성 매핑과 조회 예시
입력한 스칼라를 c, 해당 Unicode 코드 포인트를 N이라고 하겠습니다. 10진수 N, 대문자 16진수 N, 그리고 최소 4자리 16진수 뒤에 U+를 붙인 표기를 출력합니다. 입력값 😀은 N = 128512 = 1×65536 + 15×4096 + 6×256 + 0×16 + 0이므로 16진수 1F600이 됩니다. 정확한 결과는 U+1F600\nDecimal: 128512\nHex: 0x1F600입니다. 이 방향의 출력에서는 기호 자체를 반복하지 않습니다. 10진수와 16진수는 서로 다른 인코딩이 아니라 동일한 N을 설명합니다. Unicode inspector는 이 단일 스칼라 필드에서 거부되는 여러 스칼라 시퀀스를 검사하는 데 도움이 됩니다.
스칼라, 서로게이트 절반과 표시
Unicode 핵심 사양(https://www.unicode.org/versions/latest/core-spec/)은 스칼라 값과 UTF-16 서로게이트 코드 포인트를 구분합니다. U+D800–U+DFFF 값은 거부되며, 스칼라가 0개 또는 여러 개인 문자열도 거부됩니다. U+0000은 보이지 않지만 유효합니다. 필드의 길이는 16코드 포인트로 제한되지만, 그렇다고 16자 조회가 허용되는 것은 아닙니다. 허용되는 모든 코드 포인트는 U+10FFFF 이하이며 JavaScript Number에 정확하게 들어가므로, 일반적인 진법 변환에서 발생하는 큰 정수 정밀도 문제는 생기지 않습니다. 글리프 모양은 선택한 글꼴에 따라 달라집니다.
사용 방법
- 아래에 표시된 형식으로 값을 입력합니다.
- 변환을 실행하고 결과를 입력한 소스의 표기 규칙과 비교합니다.
- 대상에서 필요한 형식으로 출력을 복사하거나 다운로드합니다.
개인정보 보호 및 제한사항
변환은 브라우저에서 실행됩니다. 입력한 값과 결과는 업로드하지 않습니다.
관련 도구
자주 묻는 질문
단일 이모지가 두 개 이상의 문자로 인식되어 거부되는 이유는 무엇인가요?
화면에 하나로 표시되는 일부 이모지는 국기, 피부색 변형, 폭이 0인 접합자로 연결된 가족 이모지처럼 여러 요소의 시퀀스로 구성됩니다. 이 입력란은 시각적 문자소 하나가 아니라 스칼라 하나를 허용합니다. Unicode 검사 도구로 시퀀스를 구성 요소 스칼라로 나눈 다음, 각 구성 요소를 여기에서 확인하십시오.
é와 e 뒤에 악센트가 붙은 문자는 같은 입력인가요?
두 문자는 동일하게 보일 수 있지만, 첫 번째는 U+00E9라는 하나의 스칼라일 수 있고 두 번째는 U+0065 뒤에 U+0301이 오는 형태일 수 있습니다. 두 번째 형식은 여러 스칼라이므로 거부됩니다. 조회 전에 정규화를 적용하지 않으므로, 이 도구는 표준 표기를 임의로 선택하지 않고 입력한 표현을 그대로 보여 줍니다.
10진수 결과는 바이트 값이나 문자열 길이를 의미하나요?
이는 스칼라의 숫자 식별자입니다. 😀의 값은 128512이지만 UTF-8 표현에는 4바이트가 필요하고 JavaScript 문자열에서는 UTF-16 코드 단위 2개를 차지합니다. 이 측정값들은 서로 다른 질문에 답합니다. 바이트를 확인하려면 10진수 식별자를 인코딩된 바이트로 간주하지 말고 Text to Hex를 사용하십시오.
무료 도구 · 브라우저에서회 실행 · 계정 불필요