UTILS.
100% en el navegador
🔤

Conversor de puntos de código Unicode

Inspecciona texto y convierte cada carácter a su punto de código Unicode, bytes UTF-8/UTF-16, entidad HTML y escape, o reconstruye texto a partir de puntos de código.

Introduce texto o puntos de código arriba.

Acerca de esta herramienta

El Conversor de puntos de código Unicode descompone el texto carácter por carácter y muestra cada representación común de cada uno, y también funciona a la inversa para reconstruir una cadena a partir de puntos de código que pegas. En modo directo itera por punto de código (no por unidad UTF-16), así que los caracteres astrales y los emoji formados por pares sustitutos se manejan correctamente como caracteres únicos.

Para cada carácter informa del punto de código hex U+, el punto de código decimal, la secuencia de bytes UTF-8 en hex (mediante el TextEncoder del navegador), las unidades de código UTF-16 en hex, la entidad HTML numérica (&#nnnn;), y el escape de JavaScript/JSON (\uXXXX, o \u{...} para puntos de código por encima de U+FFFF). Esto es ideal para depurar problemas de codificación, detectar caracteres invisibles o parecidos, o construir secuencias de escape para código fuente.

En modo inverso pegas puntos de código en casi cualquier notación —U+1F600, decimal plano, \uXXXX, \u{1F600}, 😀, 😀 o hex con prefijo 0x, separados por espacios o comas— y la herramienta valida cada uno (rechazando valores por encima de U+10FFFF y sustitutos sueltos) y reconstruye la cadena con String.fromCodePoint. Todo el procesamiento es local en tu navegador, así que el texto privado nunca sale de la página.

Preguntas frecuentes

¿Maneja emoji y caracteres astrales?
Sí. El modo directo itera por punto de código Unicode, así que un emoji como 😀 (U+1F600), que se almacena como un par sustituto UTF-16, se trata como un carácter y su escape se emite como \u{1F600}.
¿Qué formatos acepta el modo inverso?
Hex U+XXXX, decimal plano, escapes de JavaScript \uXXXX y \u{XXXXX}, entidades HTML &#nnnn; y &#xHHHH;, y hex con prefijo 0x. Separa varios puntos de código con espacios o comas y la cadena se reconstruye en orden.
¿Cuál es la diferencia entre las columnas UTF-8 y UTF-16?
UTF-8 muestra los 1–4 bytes usados para almacenar el carácter en la codificación UTF-8, mientras que UTF-16 muestra las unidades de código de 16 bits (una, o dos para un par sustituto). Ambas se dan en hex para el mismo carácter.
¿Se rechaza la entrada inválida?
Sí. El modo inverso marca cualquier cosa que no sea un valor escalar Unicode válido —puntos de código por encima de U+10FFFF o en el rango sustituto U+D800–U+DFFF— así que nunca construyes una cadena malformada.

Más herramientas