인코딩 데스크
텍스트를 Hex로
텍스트를 대문자 UTF-8 바이트로 인코딩해 읽기 쉬운 공백 구분 Hex 형식으로 표시합니다.
텍스트를 Hex로: 텍스트 문자열의 UTF-8 바이트를 공백으로 구분된 대문자 16진수 쌍으로 표시합니다. 텍스트를 Hex로 변환하면 공백, 줄 끝 문자, 멀티바이트 문자를 확인할 수 있습니다. 복사한 텍스트를 비교하거나 인코딩 예시를 준비할 때 사용하십시오. 바이트 시퀀스는 텍스트를 나타내며 숫자 진법 변환 결과가 아닙니다. 서버에 파일을 전혀 업로드하지 않고 브라우저에서 100% 로컬로 실행됩니다.
- 카테고리
- 개발자 도구
- 실행 횟수
- 브라우저에서
- 비용
- 무료 · 가입 불필요
- 사용 가능 여부
- 사용 가능
브라우저에서 전부 실행됩니다
결과
준비됨출력은 바이트 사이를 공백으로 구분한 대문자 UTF-8 Hex입니다. 텍스트는 로컬에서 인코딩하며 업로드하지 않습니다.
혼합 예시를 통한 바이트 표시 규칙
먼저 입력을 UTF-8 바이트 b_1부터 b_m까지로 인코딩한 다음, 각 바이트를 2개의 대문자 16진수 숫자로 쓰고 바이트 사이를 공백 하나로 구분합니다. m > 0일 때 표시 길이 = 2m + (m − 1) = 3m − 1입니다. 입력값 Aé의 바이트는 10진수로 65, 195, 169이므로 41 C3 A9가 됩니다. m = 3이면 표시 길이는 3×3 − 1 = 8자입니다. A는 1바이트, é는 2바이트를 차지하며 C3과 A9 사이의 공백은 입력 공백이 아니라 출력 형식입니다. URL encoding은 자체 이스케이프 규칙을 사용해 URL 컨텍스트에 맞는 텍스트를 준비합니다.
UTF-8 유효성과 용량
RFC 3629(https://www.rfc-editor.org/rfc/rfc3629)는 UTF-8 바이트 시퀀스를 설명합니다. 입력 문자열에 단독 UTF-16 서로게이트가 있으면 인코딩 과정에서 U+FFFD로 대체되어 EF BF BD로 표시됩니다. 이는 서로게이트 값을 거부하는 스칼라 전용 문자 도구와 다릅니다. 텍스트는 100,000 코드 포인트로 제한되며, 편집기는 UTF-16 단위도 100,000자 허용량에 포함해 계산합니다. 많은 이모지는 이 단위 2개를 사용합니다. 표시되는 출력은 구분 공백을 포함해 400,000자로 제한됩니다. 따라서 최대 길이의 비ASCII 입력이 모두 처리되는 것은 아닙니다. 멀티바이트 인코딩으로 결과가 늘어나기 때문입니다. 출력 제한에 도달하면 원본 텍스트를 저장하고 더 작은 부분으로 나누어 시도하십시오.
사용 방법
- 아래에 표시된 형식으로 값을 입력합니다.
- 변환을 실행하고 결과를 원본의 규칙과 비교합니다.
- 대상에서 요구하는 형식으로 결과를 복사하거나 다운로드합니다.
개인정보 보호 및 제한사항
변환은 브라우저에서 실행됩니다. 입력한 값과 결과는 업로드하지 않습니다.
관련 도구
자주 묻는 질문
악센트가 붙은 문자 하나가 여러 바이트 쌍으로 표시되는 이유는 무엇인가요?
UTF-8은 유니코드 스칼라 값마다 1~4바이트를 사용하므로 바이트 수와 눈에 보이는 문자 수가 다릅니다. é 문자는 C3 A9가 되며, 이모지는 4바이트가 필요할 수 있습니다. 조합된 문자와 문자 뒤에 결합 문자가 이어진 형태는 비슷하게 보여도 서로 다른 바이트 시퀀스를 만들 수 있습니다.
인코딩하기 전에 줄 바꿈과 공백을 제거하나요?
아니요. 일반 공백은 20, 탭은 09, LF는 0A, CRLF는 0D 0A가 됩니다. 변환기는 텍스트나 줄 끝 형식을 정규화하지 않습니다. 브라우저에 붙여넣는 과정에서 원본의 줄 끝 형식이 이미 바뀌었을 수 있으므로, 이 도구는 실제로 입력된 텍스트의 바이트를 표시합니다.
이 결과는 UTF-16, BCD 또는 리틀 엔디언 정수인가요?
항상 UTF-8 텍스트로 인코딩합니다. 텍스트로 입력한 숫자는 문자 바이트가 되므로 42는 일반 정수의 2A나 패킹된 BCD의 42가 아니라 34 32가 됩니다. 숫자 필드 길이나 엔디언 설정은 없으며, 이 바이트 쌍을 뒤집으면 많은 멀티바이트 문자가 손상됩니다.
무료 도구 · 브라우저에서회 실행 · 계정 불필요