Inspector de caracteres Unicode

Cada carácter con su punto de código, sus bytes y las trampas invisibles.

15 puntos de código en 18 bytes.

Carácter por carácter
A U+0041 — mayúscula, UTF-8 41, A ñ U+00F1 — eñe, UTF-8 C3 B1, ñ o U+006F — minúscula, UTF-8 6F, o U+0020 — espacio, UTF-8 20,   1 U+0031 — cifra, UTF-8 31, 1 . U+002E — signo de puntuación, UTF-8 2E, . º U+00BA — indicador ordinal masculino, UTF-8 C2 BA, º U+0020 — espacio, UTF-8 20,   a U+0061 — minúscula, UTF-8 61, a U+0020 — espacio, UTF-8 20,   3 U+0033 — cifra, UTF-8 33, 3 0 U+0030 — cifra, UTF-8 30, 0 U+0020 — espacio, UTF-8 20,   ° U+00B0 — signo de grado, UTF-8 C2 B0, ° C U+0043 — mayúscula, UTF-8 43, C
Caracteres invisibles
ninguno — en el texto no hay caracteres invisibles
Forma normal
NFC — los caracteres ya están compuestos
Tamaño en bytes
18 bytes en UTF-8, 15 puntos de código, 15 unidades UTF-16
Aviso
Los puntos de código y las unidades UTF-16 coinciden: el texto no lleva caracteres fuera del plano básico.

Dos textos pueden verse idénticos en pantalla y ser distintos para cualquier comparación. Una ñ puede ser una sola letra o una n con una tilde suelta encima, un espacio puede ser normal o duro, y un guion puede ser un signo menos o una raya.

El inspector descompone el texto en sus puntos de código y da de cada uno el número, los bytes en UTF-8 y la entidad HTML. Los caracteres invisibles y los fáciles de confundir se señalan aparte.

Eñes descompuestas

macOS guarda los nombres de archivo descompuestos: la ñ de «Año» aparece allí como una n seguida de una tilde combinante, es decir, como dos puntos de código. En pantalla no se nota nada; en cualquier comparación, búsqueda u ordenación, sí.

La solución se llama normalización: en la forma NFC esas secuencias vuelven a unirse en un solo carácter. La herramienta indica si el texto ya está en NFC, y cuando dice que no, ahí está la causa de los fallos de comparación que parecían inexplicables.

El ordinal y el grado

El indicador ordinal masculino º y el signo de grado ° se parecen tanto que se intercambian constantemente. «1.º» lleva ordinal y «30 °C» lleva grado, y quien los confunde produce datos que ningún filtro numérico reconoce.

Con las comillas pasa lo mismo: las latinas «» son las propias del español, las inglesas “” se cuelan por la autocorrección, y el apóstrofo tipográfico ’ sustituye al recto sin avisar y rompe consultas y comparaciones.

Preguntas frecuentes

¿Por qué mi texto es más largo de lo que parece?
Porque los caracteres fuera del plano básico —la mayoría de los emojis— cuentan como dos unidades en JavaScript y en muchas bases de datos, y porque los caracteres combinantes son puntos de código propios. La herramienta muestra las dos cifras por separado.
¿Qué diferencia hay entre ° y º?
El primero es el signo de grado U+00B0 y el segundo el indicador ordinal masculino U+00BA, el de «1.º». Se parecen mucho, y en los datos de medición aparece constantemente el que no toca.

Fuentes

Cifras vigentes en 2026. Los resultados son orientativos y no sustituyen a una asesoría laboral o fiscal.

También te puede servir