Encodage
Unicode Escape
Encodage et décodage de séquences Unicode — caractères au format \uXXXX et inversement.
A Unicode escape sequence (\uXXXX) writes a character as its code point instead of the character itself — so a string literal in code can contain any Unicode character while the source file itself stays plain ASCII.
How to use it
- Encode: paste text and every non-ASCII character gets replaced with its matching \uXXXX sequence.
- Decode: paste a string containing \uXXXX sequences to get plain, readable text back.
- Characters outside the Basic Multilingual Plane (most emoji) are encoded as a surrogate pair of two sequences.
Common uses
- Reading JSON or JS code where non-ASCII text was pre-escaped into \uXXXX for compatibility.
- Inserting a character that's not on the keyboard into code via an explicit Unicode escape.
- Debugging why a string with an emoji shows up as two odd characters — recognizing a surrogate pair.
Things to keep in mind
\uXXXX encodes exactly one 16-bit UTF-16 unit, not one visible character — characters outside the Basic Multilingual Plane (most emoji) need two such sequences together (a surrogate pair).
JSON only requires escaping for control characters and a few special characters — escaping every character as \uXXXX isn't required, though it is valid.
Article sur cet outil: Unicode Escape : que signifient les séquences \uXXXX
Questions fréquentes
Que représente une séquence \uXXXX ?
C'est une notation qui encode un caractère par son point de code Unicode en hexadécimal sur 4 chiffres, utilisée notamment en JavaScript, JSON et Java pour représenter des caractères non ASCII dans du code source ou du texte.
Pourquoi certains emojis apparaissent-ils encodés en deux séquences \uXXXX ?
Les caractères situés hors du plan de base Unicode (BMP), comme la plupart des emojis, ne tiennent pas sur 16 bits. Ils sont représentés par une paire de substituts (surrogate pair), soit deux séquences \uXXXX consécutives qui, combinées, désignent un seul caractère.
Mes données sont-elles envoyées sur un serveur ?
Non, l'encodage et le décodage se font entièrement dans le navigateur. Rien n'est transmis à un serveur.
Que se passe-t-il si une paire supplétive est coupée en deux ?
On obtient un caractère « orphelin » invalide — un code isolé sans son équivalent associé. La plupart des analyseurs rejettent une telle chaîne avec une erreur, ou affichent un caractère de remplacement « � ».
Peut-on encoder un emoji avec un seul \uXXXX ?
Non, si l'emoji se situe hors du plan multilingue de base (ce qui est le cas de la plupart des emojis actuels) — il nécessite toujours une paire supplétive composée de deux séquences \uXXXX.