Texto / Codificación
Contador de bytes (UTF-8, UTF-16 y SMS)
Cuenta los bytes de un texto en UTF-8 y UTF-16, sus puntos de código y caracteres visibles, y las partes de SMS que necesita. También puedes cortarlo hasta un límite de bytes sin dividir ningún carácter.
Contador de bytes (UTF-8, UTF-16 y SMS): Los distintos sistemas miden la longitud de maneras diferentes. UTF-8, que usan las páginas web y la mayoría de las bases de datos, ocupa 1 byte para ASCII, 2 para la mayoría de las letras acentuadas y de las letras griegas o cirílicas, 3 para los caracteres chinos, japoneses y coreanos, y 4 para los emojis. JavaScript cuenta unidades de código UTF-16, Python cuenta puntos de código y las personas ven grupos de grafemas, por lo que un emoji con tono de piel es un carácter para quien lo lee, pero equivale a dos puntos de código y ocho bytes UTF-8. Los mensajes SMS admiten 160 caracteres del alfabeto GSM o 70 si aparece cualquier otro carácter. Funciona al 100 % en tu navegador, sin subir archivos a ningún servidor.
- Categoría
- Herramientas de texto
- Se ejecuta
- En tu navegador
- Coste
- Gratis · sin registro
- Disponibilidad
- Lista para usar
Funciona por completo en tu navegador
Estos caracteres no forman parte del alfabeto GSM, por lo que el mensaje completo se envía como UCS-2, con 70 caracteres por parte: 👍 🏽 日 本 語
Contiene caracteres de 4 bytes, como emojis: MySQL necesita el juego de caracteres utf8mb4 para almacenarlos; su antiguo juego utf8 (utf8mb3) los rechaza.
Límites medidos en bytes
Muchos límites cuentan bytes, no caracteres: columnas e índices de bases de datos, encabezados y cookies HTTP (aproximadamente 4 KB por cookie), nombres de archivo (255 bytes en la mayoría de los sistemas de archivos) y APIs de pagos o mensajería. Un límite que admite 255 letras en inglés puede contener solo 85 caracteres chinos o 63 emoji.
Para límites contados en caracteres, como las publicaciones en redes sociales, usa el contador de caracteres; para averiguar cómo está codificado un archivo, usa el detector de codificación de texto.
Mantener cortos los mensajes SMS
Sustituye las comillas y los apóstrofos curvos por sus versiones rectas, los guiones largos por guiones normales y evita los emoji para que el mensaje se mantenga en el alfabeto GSM y admita 160 caracteres por parte en lugar de 70. Cada parte adicional suele facturarse como un mensaje independiente.
Cómo se usa
- Escribe o pega el texto.
- Consulta el número de bytes, caracteres y partes de SMS.
- Introduce un límite de bytes para comprobar si el texto cabe y obtener una versión cortada de forma segura.
Privacidad y límites
El texto se mide en tu navegador y nunca se sube.
Herramientas relacionadas
Preguntas frecuentes
¿Por qué mi base de datos dice que el texto es demasiado largo?
Los límites de las columnas pueden contar bytes en lugar de caracteres: los prefijos de índice de MySQL y muchos sistemas antiguos usan bytes, por lo que 255 caracteres chinos necesitan 765 bytes en UTF-8.
¿Por qué un emoji hace que mi SMS se envíe como Unicode?
Los SMS usan el alfabeto GSM de 7 bits cuando todos los caracteres pertenecen a él; un solo carácter que no forme parte del alfabeto, como un emoji o unas comillas curvas, cambia todo el mensaje a UCS-2, que admite 70 caracteres por parte en lugar de 160.
¿En qué se divide un SMS largo?
En partes de 153 caracteres GSM o 67 unidades UCS-2, ya que cada parte incluye una cabecera para unirlas en el teléfono; algunos caracteres, como € y [ ], cuentan como dos en GSM.
Herramienta gratuita · se ejecuta en tu navegador · sin cuenta