Saltar al contenido

Inspector de caracteres Unicode

Divide el texto en caracteres individuales y muestra el punto de código, nombre, bloque, categoría y tamaño de cada uno.

Entrada

Inspector de caracteres Unicode

Pega cualquier texto y esta herramienta lo divide en caracteres individuales, mostrando para cada uno su punto de código (U+XXXX), un nombre legible, su bloque Unicode, su categoría general (letra, marca, puntuación, símbolo, separador o control), una dirección de texto aproximada y cuántos bytes ocupa en UTF-8. Está diseñada para esos momentos cuando el texto se ve bien pero se comporta de manera extraña: una "comilla inteligente" que rompe un analizador JSON, un espacio de ancho cero que se copiaba de una página web, un homoglifo oculto en un nombre de dominio, o un emoji que resulta ser varios puntos de código pegados juntos.

Activa "combinar caracteres idénticos" para fusionar repeticiones en una fila por carácter distinto con un recuento de ocurrencias: la forma más rápida de responder "¿qué caracteres aparecen realmente en este archivo y con qué frecuencia?". "Solo caracteres no ASCII" oculta A-Z, dígitos y puntuación básica para que un documento largo solo muestre los caracteres que vale la pena revisar. "Descomponer emoji compuestos" divide secuencias construidas a partir de varios puntos de código (banderas, emoji familiares, variantes de tono de piel) en sus elementos básicos en lugar de enumerar toda la secuencia como una fila. Elige una tabla simple para leer en pantalla o CSV para pegar en una hoja de cálculo.

Los nombres de caracteres provienen de una tabla integrada grande que cubre ASCII, letras latinas con acento (construidas con la misma regla base-letra-más-diacrítico que utiliza Unicode), cirílico, griego, símbolos comunes, ideogramas CJK y sílabas Hangul, no una copia de la base de datos completa de ~150.000 nombres Unicode, que sería demasiado grande para enviar a una pestaña del navegador. Los puntos de código raros o sin asignar recurren a una descripción basada en bloques en lugar de una suposición, y las preguntas frecuentes a continuación indican exactamente dónde está la línea.

Todo se ejecuta localmente en tu navegador: el texto que inspecciones, incluyendo contraseñas, notas privadas o cualquier otra cosa que no pegarías en un formulario web aleatorio, nunca se carga en ningún lugar. Copia el resultado, descárgalo como un archivo .txt o envíalo directamente a otra herramienta.

Preguntas frecuentes

¿Por qué un emoji a veces aparece como varias filas?
Los emoji como banderas, grupos familiares o variantes de tono de piel a menudo se construyen a partir de más de un punto de código Unicode unido. De forma predeterminada, la herramienta los muestra como un carácter; activa "descomponer emoji compuestos" para ver los puntos de código individuales que los conforman.
¿Qué significa "bloque" aquí?
Un bloque Unicode es un rango nombrado de puntos de código, como "Latin básico" o "Cirílico". Agrupa caracteres según dónde viven en el estándar Unicode, lo que es diferente de su categoría general (letra, puntuación, símbolo, etc.).
¿Son los nombres de caracteres siempre el nombre Unicode oficial?
Para ASCII, letras latinas comunes con acento, cirílico, griego, ideogramas CJK, sílabas Hangul y un amplio conjunto de símbolos y emoji comunes, sí. Para puntos de código más raros, la herramienta muestra un fallback descriptivo basado en el bloque en lugar de adivinar un nombre exacto: la base de datos completa de nombres oficiales tiene alrededor de 150.000 entradas y no cabe en una página enviada a tu navegador.
¿Cómo se determina la dirección del texto?
Es una comprobación simplificada, no el algoritmo Unicode bidireccional completo: las letras de scripts de derecha a izquierda (árabe, hebreo y similares) se marcan como "rtl", otras letras y dígitos se marcan como "ltr", y la puntuación, símbolos y espacios se marcan como "neutral".
¿Se carga mi texto en algún lugar?
No. Cada carácter se inspecciona completamente en tu navegador: nada de lo que pegues aquí se envía a un servidor.