Testo / Codifica
Contatore di byte (UTF-8, UTF-16 e SMS)
Conta i byte del testo in UTF-8 e UTF-16, i punti di codice e i caratteri visibili, oltre alle parti SMS necessarie; taglialo a un limite di byte senza spezzare un carattere.
Contatore di byte (UTF-8, UTF-16 e SMS): I diversi sistemi misurano la lunghezza in modi diversi. UTF-8, usato dalle pagine web e dalla maggior parte dei database, utilizza 1 byte per i caratteri ASCII, 2 per la maggior parte delle lettere accentate, greche o cirilliche, 3 per i caratteri cinesi, giapponesi e coreani e 4 per le emoji. JavaScript conta le unità di codice UTF-16, Python conta i punti di codice e le persone vedono i cluster di grafemi: perciò un'emoji con tonalità della pelle è un carattere per chi legge, ma equivale a due punti di codice e a otto byte UTF-8. I messaggi SMS possono contenere 160 caratteri dell'alfabeto GSM oppure 70 se compare un carattere diverso. Funziona al 100% localmente nel browser, senza caricare file sul server.
- Categoria
- Strumenti per il testo
- Esecuzioni
- Nel browser
- Costo
- Gratuito · senza registrazione
- Disponibilità
- Pronto all'uso
Funziona interamente nel browser
Questi caratteri non appartengono all'alfabeto GSM, quindi l'intero messaggio viene inviato come UCS-2, con 70 caratteri per parte: 👍 🏽 日 本 語
Contiene caratteri di 4 byte, come le emoji: MySQL richiede il set di caratteri utf8mb4 per memorizzarli; il suo vecchio set utf8 (utf8mb3) li rifiuta.
Limiti misurati in byte
Molti limiti contano i byte, non i caratteri: colonne di database e chiavi di indice, intestazioni HTTP e cookie (circa 4 KB per cookie), nomi di file (255 byte nella maggior parte dei file system) e API per pagamenti o messaggi. Un limite che contiene 255 lettere inglesi può contenere solo 85 caratteri cinesi o 63 emoji.
Per i limiti conteggiati in caratteri, come quelli dei post sui social, usa il contatore di caratteri; per scoprire come è codificato un file, usa il rilevatore della codifica del testo.
Mantenere brevi i messaggi SMS
Sostituisci virgolette e apostrofi tipografici con quelli semplici, i trattini lunghi con i trattini brevi ed evita le emoji, così il messaggio resta nell'alfabeto GSM e può contenere 160 caratteri per parte invece di 70. Ogni parte aggiuntiva viene solitamente fatturata come un messaggio separato.
Come usarlo
- Scrivi o incolla il testo.
- Leggi il numero di byte, di caratteri e di parti SMS.
- Inserisci un limite di byte per verificare se il testo rientra e ottenere una versione troncata in modo sicuro.
Privacy e limitazioni
Il testo viene misurato nel tuo browser e non viene mai caricato.
Strumenti correlati
Domande frequenti
Perché il mio database dice che il testo è troppo lungo?
I limiti delle colonne possono contare i byte anziché i caratteri: i prefissi degli indici MySQL e molti sistemi meno recenti usano i byte, quindi 255 caratteri cinesi richiedono 765 byte in UTF-8.
Perché una sola emoji invia il mio SMS come Unicode?
Gli SMS usano l'alfabeto GSM a 7 bit quando ogni carattere ne fa parte; un solo carattere esterno, come un'emoji o una virgolette curva, converte l'intero messaggio in UCS-2, che consente 70 caratteri per parte invece di 160.
In che cosa viene suddiviso un SMS lungo?
In parti da 153 caratteri GSM o 67 unità UCS-2, perché ogni parte contiene un'intestazione per ricomporle sul telefono; alcuni caratteri, come € e [ ], contano due volte nel GSM.
Strumento gratuito · nel browser esecuzioni · senza account