Testo / Codifica

Contatore di byte (UTF-8, UTF-16 e SMS)

Conta i byte del testo in UTF-8 e UTF-16, i punti di codice e i caratteri visibili, oltre alle parti SMS necessarie; taglialo a un limite di byte senza spezzare un carattere.

Contatore di byte (UTF-8, UTF-16 e SMS): I diversi sistemi misurano la lunghezza in modi diversi. UTF-8, usato dalle pagine web e dalla maggior parte dei database, utilizza 1 byte per i caratteri ASCII, 2 per la maggior parte delle lettere accentate, greche o cirilliche, 3 per i caratteri cinesi, giapponesi e coreani e 4 per le emoji. JavaScript conta le unità di codice UTF-16, Python conta i punti di codice e le persone vedono i cluster di grafemi: perciò un'emoji con tonalità della pelle è un carattere per chi legge, ma equivale a due punti di codice e a otto byte UTF-8. I messaggi SMS possono contenere 160 caratteri dell'alfabeto GSM oppure 70 se compare un carattere diverso. Funziona al 100% localmente nel browser, senza caricare file sul server.

Esecuzioni
Nel browser
Costo
Gratuito · senza registrazione
Disponibilità
Pronto all'uso
Contatore di byteElaborazione locale

Funziona interamente nel browser

Byte UTF-824pagine web, file, la maggior parte dei database
Byte UTF-1626JavaScript, Java, Windows
Caratteri visualizzati10cluster di grafemi
Punti di codice11ciò che conta len() di Python
Lunghezza JavaScript13Unità di codice UTF-16
Parole e righe3 · 1
Parti dell'SMS1UCS-2 · 13 di 70 per parte

Questi caratteri non appartengono all'alfabeto GSM, quindi l'intero messaggio viene inviato come UCS-2, con 70 caratteri per parte: 👍 🏽 日 本 語

Contiene caratteri di 4 byte, come le emoji: MySQL richiede il set di caratteri utf8mb4 per memorizzarli; il suo vecchio set utf8 (utf8mb3) li rifiuta.

Limiti misurati in byte

Molti limiti contano i byte, non i caratteri: colonne di database e chiavi di indice, intestazioni HTTP e cookie (circa 4 KB per cookie), nomi di file (255 byte nella maggior parte dei file system) e API per pagamenti o messaggi. Un limite che contiene 255 lettere inglesi può contenere solo 85 caratteri cinesi o 63 emoji.

Per i limiti conteggiati in caratteri, come quelli dei post sui social, usa il contatore di caratteri; per scoprire come è codificato un file, usa il rilevatore della codifica del testo.

Mantenere brevi i messaggi SMS

Sostituisci virgolette e apostrofi tipografici con quelli semplici, i trattini lunghi con i trattini brevi ed evita le emoji, così il messaggio resta nell'alfabeto GSM e può contenere 160 caratteri per parte invece di 70. Ogni parte aggiuntiva viene solitamente fatturata come un messaggio separato.

Come usarlo

  1. Scrivi o incolla il testo.
  2. Leggi il numero di byte, di caratteri e di parti SMS.
  3. Inserisci un limite di byte per verificare se il testo rientra e ottenere una versione troncata in modo sicuro.

Privacy e limitazioni

Il testo viene misurato nel tuo browser e non viene mai caricato.

Strumenti correlati

Domande frequenti

Perché il mio database dice che il testo è troppo lungo?

I limiti delle colonne possono contare i byte anziché i caratteri: i prefissi degli indici MySQL e molti sistemi meno recenti usano i byte, quindi 255 caratteri cinesi richiedono 765 byte in UTF-8.

Perché una sola emoji invia il mio SMS come Unicode?

Gli SMS usano l'alfabeto GSM a 7 bit quando ogni carattere ne fa parte; un solo carattere esterno, come un'emoji o una virgolette curva, converte l'intero messaggio in UCS-2, che consente 70 caratteri per parte invece di 160.

In che cosa viene suddiviso un SMS lungo?

In parti da 153 caratteri GSM o 67 unità UCS-2, perché ogni parte contiene un'intestazione per ricomporle sul telefono; alcuni caratteri, come € e [ ], contano due volte nel GSM.

Strumento gratuito · nel browser esecuzioni · senza account