Area codifica
Punto di codice Unicode
Mappa un valore scalare Unicode nella notazione U+, in formato decimale ed esadecimale.
Punto di codice Unicode: Trova l'identificatore numerico Unicode di un singolo valore scalare. Punto di codice Unicode mostra la notazione U+ insieme ai formati decimale ed esadecimale. Usalo per distinguere caratteri dall'aspetto simile o identificare un simbolo incollato, ricordando che un singolo simbolo visibile può contenere diversi valori scalari. Funziona al 100% localmente nel browser, senza caricare file sul server.
- Categoria
- Strumenti per sviluppatori
- Esecuzioni
- Nel browser
- Costo
- Gratuito · senza registrazione
- Disponibilità
- Pronto all'uso
Funziona interamente nel browser
Risultato
ProntoI punti di codice surrogati non sono valori scalari Unicode e vengono rifiutati.
Mappatura dell’identità e ricerca svolta
Sia c lo scalare inserito e N il suo punto di codice Unicode. Restituisci N in decimale, N in esadecimale maiuscolo e U+ seguito da almeno quattro cifre esadecimali. L’input 😀 ha N = 128512 = 1×65536 + 15×4096 + 6×256 + 0×16 + 0, ottenendo l’esadecimale 1F600. Il risultato esatto è U+1F600\nDecimal: 128512\nHex: 0x1F600. Il simbolo non viene ripetuto nell’output di questa direzione. Decimale ed esadecimale descrivono lo stesso N, non codifiche separate. Lo strumento di ispezione Unicode aiuta ad analizzare sequenze con più scalari, rifiutate da questo campo a scalare singolo.
Scalari, metà surrogate e visualizzazione
La specifica principale Unicode (https://www.unicode.org/versions/latest/core-spec/) distingue i valori scalari dai punti di codice surrogati UTF-16. I valori U+D800–U+DFFF vengono rifiutati, così come le stringhe contenenti zero o più scalari. U+0000 è valido anche se invisibile. Il campo ha un limite di 16 punti di codice, ma ciò non consente una ricerca di sedici caratteri. Tutti i punti di codice accettati sono inferiori o uguali a U+10FFFF e rientrano esattamente in un JavaScript Number; il problema della precisione degli interi grandi delle conversioni di base generiche non si presenta. La forma del glifo dipende comunque dal font selezionato.
Come usarlo
- Inserisci il valore nel formato mostrato qui sotto.
- Avvia la conversione e verifica il risultato in base alla convenzione usata dalla tua sorgente.
- Copia o scarica l'output nel formato richiesto dalla destinazione.
Privacy e limitazioni
La conversione funziona nel browser. I tuoi valori e risultati non vengono caricati.
Strumenti correlati
Domande frequenti
Perché la mia singola emoji viene rifiutata come composta da più caratteri?
Alcune emoji visualizzate sono sequenze, incluse le bandiere, le varianti con tonalità della pelle e le famiglie unite da connettori a larghezza zero. Questo campo accetta un singolo valore scalare, non un singolo grafema visivo. Separa la sequenza nei suoi valori scalari componenti con uno strumento di ispezione Unicode, poi cerca qui ogni componente.
é e una e seguita da un accento sono lo stesso input?
Possono sembrare identiche, ma la prima può essere un singolo valore scalare U+00E9, mentre la seconda è composta da U+0065 seguito da U+0301. La seconda forma viene rifiutata perché contiene più valori scalari. Prima della ricerca non viene applicata alcuna normalizzazione, quindi lo strumento mostra la rappresentazione inserita invece di scegliere una grafia canonical.
Il risultato decimale indica un valore in byte o la lunghezza della stringa?
È l'identificatore numerico di un valore scalare. Per 😀 è 128512, mentre la sua rappresentazione UTF-8 richiede quattro byte e la sua stringa JavaScript occupa due unità di codice UTF-16. Sono misure che rispondono a domande diverse. Usa Text to Hex per i byte, invece di trattare l'identificatore decimale come un byte codificato.
Strumento gratuito · nel browser esecuzioni · senza account