Herramienta de desarrollo / 17

Inspector de Unicode y caracteres invisibles

Inspecciona texto en busca de espacios de ancho cero ocultos, caracteres de control, marcas de anulación RTL y puntos de código Unicode.

Inspector de Unicode y caracteres invisibles: TOEA descompone el texto en puntos de código Unicode individuales, identifica caracteres invisibles (como ZWSP o NBSP) y calcula las secuencias de bytes UTF-8. Funciona al 100 % en tu navegador, sin subir archivos a ningún servidor.

Se ejecuta
En tu navegador
Coste
Gratis · sin registro
Disponibilidad
Lista para usar
Inspector de Unicode y de caracteres invisiblesProcesamiento local

Funciona por completo en tu navegador

Resumen de texto y caracteres

Recuento de caracteres26
Puntos de código25
Bytes UTF-833
Invisible / de ancho cero3

Desglose detallado de puntos de código

Pos.CarácterPunto de códigoBytes UTF-8Categoría / Nombre
0HU+004848Letter 'H'
1eU+006565Letter 'e'
2lU+006C6CLetter 'l'
3lU+006C6CLetter 'l'
4oU+006F6FLetter 'o'
5⚠️U+200BE2 80 8BZero Width Space[OCULTO]
6WU+005757Letter 'W'
7oU+006F6FLetter 'o'
8rU+007272Letter 'r'
9lU+006C6CLetter 'l'
10dU+006464Letter 'd'
11!U+002121Symbol '!'
12⚠️U+00A0C2 A0Non-Breaking Space (NBSP)[OCULTO]
13🚀U+1F680F0 9F 9A 80Character '🚀'
14 U+002020Space
15TU+005454Letter 'T'
16eU+006565Letter 'e'
17sU+007373Letter 's'
18tU+007474Letter 't'
19 U+002020Space
20⚠️U+200EE2 80 8ELeft-To-Right Mark[OCULTO]
21TU+005454Letter 'T'
22eU+006565Letter 'e'
23xU+007878Letter 'x'
24tU+007474Letter 't'

De dónde proceden los caracteres ocultos

La mayoría llega al copiar y pegar. Los procesadores de texto y las páginas web añaden espacios de no separación, algunos sistemas de gestión de contenidos añaden espacios de ancho cero y los editores de texto árabe o hebreo añaden marcas de dirección. Causan errores difíciles de ver: un nombre de usuario que parece correcto no coincide, grep no encuentra una palabra y Python rechaza el código fuente que contiene un espacio de no separación. Los unidores de ancho cero dentro de los emoji son legítimos, así que comprueba de qué forma parte cada carácter antes de eliminarlo.

Anulaciones de dirección

La anulación de derecha a izquierda, U+202E, invierte la visualización del texto que aparece después. Se ha usado para ocultar nombres de archivo: invoice, seguido de U+202E y fdp.exe, se muestra como invoiceexe.pdf. En 2021, el mismo truco, denominado Trojan Source, demostró que el código fuente podía mostrarse de forma distinta a como se compila. Considera sospechosa cualquier anulación que encuentres en un nombre de archivo, código o mensaje.

Caracteres que no se marcan

La lista de invisibles cubre los casos habituales. Otros caracteres que no muestran nada, como el guion blando U+00AD, el unidor de palabras U+2060, los aislantes de dirección U+2066–U+2069 y los selectores de variación como U+FE0F, aparecen como caracteres extendidos normales. Busca esos valores en la columna de puntos de código o compara los recuentos: si el texto tiene un recuento de caracteres mayor que lo que puedes ver, contiene algo oculto.

Cómo se usa

  1. Escribe o pega el texto en el campo de texto.
  2. Revisa los recuentos de caracteres, el desglose de bytes UTF-8 y los avisos de caracteres de ancho cero.
  3. Copia la lista detallada de puntos de código.

Privacidad y límites

El análisis del texto se realiza íntegramente en la memoria local del navegador.

Herramientas relacionadas

Preguntas frecuentes

¿Qué caracteres ocultos se detectan?

Espacio de ancho cero (U+200B), espacio de no separación (U+00A0), BOM (U+FEFF), ZWJ/ZWNJ y códigos de control.

¿Por qué el recuento de caracteres difiere de los puntos de código?

Los pares sustitutos o las secuencias de emoji pueden constar de varias unidades de código UTF-16 o de varios puntos de código.

Herramienta gratuita · se ejecuta en tu navegador · sin cuenta