Area codifica
Da testo a esadecimale
Codifica il testo come byte UTF-8 maiuscoli in un formato esadecimale leggibile, con spazi tra i byte.
Da testo a esadecimale: Mostra i byte UTF-8 di una stringa di testo come coppie esadecimali maiuscole separate da spazi. Da testo a esadecimale rende visibili gli spazi, le terminazioni di riga e i caratteri multibyte. Usalo per confrontare testo copiato o preparare un esempio di codifica; la sequenza di byte rappresenta testo, non una conversione da una base numerica. Funziona al 100% localmente nel browser, senza caricare file sul server.
- Categoria
- Strumenti per sviluppatori
- Esecuzioni
- Nel browser
- Costo
- Gratuito · senza registrazione
- Disponibilità
- Pronto all'uso
Funziona interamente nel browser
Risultato
ProntoOutput esadecimale UTF-8 in maiuscolo, con spazi tra i byte. Il testo viene codificato localmente e non viene mai caricato.
Regola di visualizzazione dei byte con un esempio misto
Prima codifica l’input come byte UTF-8 b_1 fino a b_m, poi scrivi ogni byte come due cifre esadecimali maiuscole, con uno spazio tra i byte. Per m > 0, la lunghezza visualizzata = 2m + (m − 1) = 3m − 1. L’input Aé ha i byte 65, 195 e 169 in decimale, che producono 41 C3 A9. Con m = 3, la visualizzazione usa 3×3 − 1 = 8 caratteri. A contribuisce con un byte ed é con due; lo spazio tra C3 e A9 è formattazione dell’output, non uno spazio nell’input. La codifica URL prepara il testo per i contesti URL usando regole di escape proprie.
Validità UTF-8 e capacità
RFC 3629 (https://www.rfc-editor.org/rfc/rfc3629) documenta le sequenze di byte UTF-8. Un surrogato UTF-16 isolato in una stringa di input viene sostituito durante la codifica da U+FFFD, visualizzato come EF BF BD; è diverso dagli strumenti per caratteri che accettano solo scalari e rifiutano i valori surrogati. Il testo è limitato a 100.000 punti di codice; l’editor conta inoltre le unità UTF-16 verso il limite di 100.000 caratteri: molte emoji ne consumano due. L’output visualizzato è limitato a 400.000 caratteri, inclusi gli spazi separatori. Di conseguenza, non tutti gli input non ASCII della lunghezza massima entrano nel limite: la codifica multibyte espande il risultato. Salva il testo sorgente e prova sezioni più piccole quando raggiungi il limite dell’output.
Come usarlo
- Inserisci il valore nel formato mostrato qui sotto.
- Esegui la conversione e confronta il risultato con la convenzione del testo sorgente.
- Copia o scarica l'output nel formato richiesto dalla destinazione.
Privacy e limitazioni
La conversione funziona nel browser. I tuoi valori e risultati non vengono caricati.
Strumenti correlati
Domande frequenti
Perché una lettera accentata produce diverse coppie di byte?
UTF-8 usa da uno a quattro byte per ogni scalare Unicode, quindi il numero di byte e quello delle lettere visibili possono differire. La lettera é produce C3 A9 e un'emoji può richiedere quattro byte. Una lettera composta e una lettera seguita da un segno combinato possono sembrare uguali, pur producendo sequenze di byte diverse.
Le nuove righe e gli spazi vengono rimossi prima della codifica?
No. Lo spazio ordinario diventa 20, una tabulazione diventa 09, LF diventa 0A e CRLF diventa 0D 0A. Il convertitore non normalizza il testo né le sue terminazioni di riga. L'incolla dal browser potrebbe aver già modificato le terminazioni di riga del testo sorgente, quindi qui vengono mostrati i byte del testo effettivamente inserito.
L'output è UTF-16, BCD o costituito da interi little-endian?
Codifica sempre il testo in UTF-8. Le cifre inserite come testo diventano byte di caratteri: 42 dà 34 32, non l'esadecimale dell'intero ordinario 2A né il BCD impacchettato 42. Non sono disponibili impostazioni per la dimensione dei campi numerici o l'endianness, e invertire queste coppie di byte corromperebbe molti caratteri multibyte.
Strumento gratuito · nel browser esecuzioni · senza account