Painel de codificação

Texto para Hexadecimal

Codifique texto como bytes UTF-8 em maiúsculas, em um formato hexadecimal limpo e separado por espaços.

Texto para Hexadecimal: Exibe os bytes UTF-8 de uma sequência de texto como pares hexadecimais em maiúsculas, separados por espaços. Texto para Hexadecimal torna visíveis os espaços, as quebras de linha e os caracteres multibyte. Use a ferramenta para comparar textos copiados ou preparar um exemplo de codificação; a sequência de bytes representa texto, não uma conversão de base numérica. Roda 100% localmente no seu navegador, sem enviar nenhum arquivo para o servidor.

Execuções
No seu navegador
Custo
Grátis · sem cadastro
Disponibilidade
Pronto para usar
Text → Hex / bancada localProcessamento local

Roda inteiramente no seu navegador

100,000 caracteres de entrada · 400,000 caracteres de saída

Resultado

Pronto

A saída é hexadecimal UTF-8 em maiúsculas, com espaços entre os bytes. O texto é codificado localmente e nunca é enviado.

Quantos bytes cada caractere ocupa

O UTF-8 usa um byte para ASCII e mais bytes para todo o restante: é é C3 A9, € é E2 82 AC e 😀 é F0 9F 98 80. Por isso, um campo limitado a 255 bytes pode comportar bem menos que 255 caracteres, e a contagem de bytes pode ser diferente da contagem de caracteres. Esses mesmos bytes, com um % antes de cada par, são produzidos pela codificação de URL.

Encontrando caracteres invisíveis

O hexadecimal revela caracteres que parecem não existir na tela. Um espaço não separável é C2 A0, e não 20. Um espaço de largura zero é E2 80 8B. Uma marca de ordem de bytes colada de um arquivo é EF BB BF. Uma quebra de linha do Windows é 0D 0A, e não 0A. Quando duas strings visualmente idênticas não são consideradas iguais, converter ambas e comparar os bytes encontra rapidamente a diferença.

Como usar

  1. Insira o valor no formato mostrado abaixo.
  2. Execute a conversão e confira o resultado com base na convenção da origem.
  3. Copie ou baixe a saída no formato exigido pelo destino.

Privacidade e limitações

A conversão é executada no seu navegador. Seus valores e resultados não são enviados.

Ferramentas relacionadas

Perguntas frequentes

Por que uma letra acentuada produz vários pares de bytes?

UTF-8 usa de um a quatro bytes por escalar Unicode, portanto a quantidade de bytes e a quantidade de letras visíveis são diferentes. A letra é produz C3 A9, e um emoji pode exigir quatro bytes. Uma letra composta e uma letra seguida de um sinal combinante podem parecer iguais, mas gerar sequências de bytes diferentes.

As quebras de linha e os espaços são removidos antes da codificação?

Não. Um espaço comum se torna 20, uma tabulação se torna 09, LF se torna 0A e CRLF se torna 0D 0A. O conversor não normaliza o texto nem suas quebras de linha. Colar texto no navegador pode já ter alterado as quebras de linha da origem, portanto o resultado mostra os bytes do texto efetivamente inserido.

A saída usa UTF-16, BCD ou inteiros little-endian?

A ferramenta sempre codifica texto UTF-8. Os dígitos inseridos como texto se tornam bytes de caracteres: 42 resulta em 34 32, não no hexadecimal do inteiro comum 2A nem em BCD empacotado 42. Não há configuração de largura de campo numérico ou endianness, e inverter esses pares de bytes corromperia muitos caracteres multibyte.

Ferramenta grátis · no seu navegador execuções · não precisa de conta