Area codifica

Da esadecimale a testo

Decodifica byte esadecimali, con o senza spazi, come testo UTF-8 con validazione rigorosa.

Da esadecimale a testo: Decodifica coppie di byte esadecimali in testo usando la validazione UTF-8 rigorosa. Da esadecimale a testo è utile per un payload di testo copiato o per un breve estratto di byte quando la codifica è nota. Rifiuta le coppie di byte malformate e il testo UTF-8 non valido invece di inserire automaticamente caratteri di sostituzione. Funziona al 100% localmente nel browser, senza caricare file sul server.

Esecuzioni
Nel browser
Costo
Gratuito · senza registrazione
Disponibilità
Pronto all'uso
Hex → Text / banco di lavoro localeElaborazione locale

Funziona interamente nel browser

Input di 400,000 caratteri · output di 100,000 caratteri

Risultato

Pronto

Il decodificatore si interrompe: i byte malformati e il testo UTF-8 non valido vengono rifiutati invece di essere sostituiti.

Assemblaggio delle coppie ed esempio decodificato

Per una coppia esadecimale con valori delle cifre h e l, byte b = 16h + l. La sequenza di byte assemblata viene quindi decodificata secondo UTF-8. Inserisci 41 C3 A9: 4×16 + 1 = 65, 12×16 + 3 = 195 e 10×16 + 9 = 169. Il byte 65 produce A, mentre i byte 195.169 insieme producono é, quindi il risultato esatto è Aé. Tre byte diventano due scalari Unicode. Leggere C3 e A9 separatamente come caratteri produrrebbe un testo errato.

Cosa garantisce la decodifica rigorosa

Le regole sulle sequenze valide provengono da RFC 3629 (https://www.rfc-editor.org/rfc/rfc3629); codifiche troppo lunghe, codifiche di surrogati e sequenze incomplete non superano la verifica. La validità non dimostra che il messaggio decodificato sia corretto o sicuro da eseguire. Un byte nullo 00 è un dato di testo valido e resta un carattere di controllo. L’input è limitato a 400.000 caratteri, inclusi spazi bianchi e prefissi, mentre il risultato decodificato è limitato a 100.000 punti di codice. Rimuovi la formattazione prima di un incolla molto grande per risparmiare spazio nell’input. L’ordine dei byte UTF-8 viene mantenuto esattamente come fornito.

Come usarlo

  1. Inserisci il valore nel formato mostrato qui sotto.
  2. Avvia la conversione e verifica il risultato in base alla convenzione della fonte.
  3. Copia o scarica l'output nel formato richiesto dalla destinazione.

Privacy e limitazioni

La conversione funziona nel browser. I tuoi valori e risultati non vengono caricati.

Strumenti correlati

Domande frequenti

Posso incollare un dump esadecimale completo con annotazioni?

Mantieni solo le coppie di byte. Gli spazi ASCII, i tab, CR e LF vengono ignorati; è accettato anche un singolo 0x iniziale. Offset, una colonna laterale ASCII, virgole e marcatori 0x ripetuti non fanno parte del formato accettato. Sono validi sia i caratteri esadecimali minuscoli sia quelli maiuscoli.

Perché E9 non funziona se mi aspettavo é?

Il singolo byte E9 non è una sequenza UTF-8 completa. Per é, inserisci C3 A9. Un errore può indicare che la fonte usa un'altra codifica, che mancano alcuni byte o che il payload è binario anziché testo. Lo strumento non cerca di indovinare la codifica e non decomprime un file.

Nel testo decodificato comparirà un marcatore d'ordine dei byte UTF-8?

Un EF BB BF iniziale viene interpretato da questo decodificatore come marcatore d'ordine dei byte. La stessa sequenza presente più avanti tra i byte diventa U+FEFF nel risultato. Il semplice UTF-8 non richiede una scelta di endianità e questo strumento non decodifica UTF-16 solo perché i suoi byte sembrano testo.

Strumento gratuito · nel browser esecuzioni · senza account