Codificación
Unicode Escape
Codificación y decodificación de secuencias Unicode — caracteres en formato \uXXXX y viceversa.
A Unicode escape sequence (\uXXXX) writes a character as its code point instead of the character itself — so a string literal in code can contain any Unicode character while the source file itself stays plain ASCII.
How to use it
- Encode: paste text and every non-ASCII character gets replaced with its matching \uXXXX sequence.
- Decode: paste a string containing \uXXXX sequences to get plain, readable text back.
- Characters outside the Basic Multilingual Plane (most emoji) are encoded as a surrogate pair of two sequences.
Common uses
- Reading JSON or JS code where non-ASCII text was pre-escaped into \uXXXX for compatibility.
- Inserting a character that's not on the keyboard into code via an explicit Unicode escape.
- Debugging why a string with an emoji shows up as two odd characters — recognizing a surrogate pair.
Things to keep in mind
\uXXXX encodes exactly one 16-bit UTF-16 unit, not one visible character — characters outside the Basic Multilingual Plane (most emoji) need two such sequences together (a surrogate pair).
JSON only requires escaping for control characters and a few special characters — escaping every character as \uXXXX isn't required, though it is valid.
Artículo sobre esta herramienta: Unicode Escape: qué significan las secuencias \uXXXX
Preguntas frecuentes
¿Qué es una secuencia de escape Unicode \uXXXX?
Es una forma de representar un carácter Unicode usando su punto de código en hexadecimal, con exactamente 4 dígitos, por ejemplo \u00e9 para "é". Se usa mucho en JSON, JavaScript y otros formatos que solo aceptan ASCII.
¿Por qué algunos emojis aparecen como dos secuencias \uXXXX seguidas?
Porque están fuera del plano básico multilingüe (BMP) y \uXXXX solo cubre 4 dígitos hexadecimales. Esos caracteres "astrales" se representan mediante un par suplente (surrogate pair): dos secuencias \uXXXX que juntas codifican un único carácter.
¿Se procesa el texto en un servidor?
No, la conversión entre texto y secuencias Unicode se hace enteramente en tu navegador, sin enviar nada a un servidor.
¿Qué pasa si se divide un par sustituto por la mitad?
Se obtiene un carácter "huérfano" no válido: un código solitario sin su pareja. La mayoría de los parsers rechazará la cadena con un error o mostrará el carácter de reemplazo «�».
¿Se puede codificar un emoji con un solo \uXXXX?
No, si el emoji está fuera del plano básico multilingüe (y la mayoría de los emojis actuales lo están), siempre hace falta un par sustituto formado por dos secuencias \uXXXX.