Encodage

XML Entities Encode/Decode

Encodage et décodage d'entités XML — les 5 standards (esperluette, chevrons, apostrophe, guillemets) et références numériques de caractères.

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

Article sur cet outil: XML Entities : échapper les caractères dans les documents XML

Questions fréquentes

Quelles sont les entités XML prédéfinies ?

Le XML ne prédéfinit que 5 entités : &amp; (esperluette), &lt; (inférieur), &gt; (supérieur), &apos; (apostrophe) et &quot; (guillemet). C'est bien moins que le HTML, qui définit des centaines d'entités nommées comme &eacute; ou &copy;.

Comment représenter un caractère hors des 5 entités prédéfinies ?

Il faut utiliser une référence numérique de caractère, en décimal (&#233;) ou en hexadécimal (&#xE9;), qui référence directement le point de code Unicode du caractère.

Mes données sont-elles envoyées sur un serveur ?

Non, l'encodage et le décodage s'exécutent entièrement dans votre navigateur. Aucun texte n'est transmis à un serveur.

Qu'est-ce que la CDATA et quand l'utiliser à la place des entités ?

La section &lt;![CDATA[...]]&gt; permet d'insérer un bloc de texte sans échapper < et & — pratique pour de gros fragments de code ou de HTML à l'intérieur d'un XML. L'exception est la séquence ]]>, qui ferme la CDATA et ne peut pas apparaître dans le contenu lui-même.

Les analyseurs XML traitent-ils les entités invalides de la même façon ?

Non, et contrairement aux navigateurs, qui « pardonnent » les erreurs en HTML, les analyseurs XML sont stricts : une seule esperluette ou un seul chevron non échappé rend tout le document invalide, et le traitement s'arrête avec une erreur.

Articles : Encodage

Base64 : à quoi sert l'encodage et comment il fonctionne

Comment Base64 transforme des données binaires en texte ASCII, et quand c'est réellement utile.

Base32 : en quoi il diffère de Base64 et quand il est plus pratique

L'alphabet de Base32, insensible à la casse, et les cas où il est plus pratique que Base64.

URL Encode/Decode : le percent-encoding dans les liens

Comment les caractères spéciaux d'une URL et de ses paramètres deviennent des séquences %XX.

HTML Entities : afficher des caractères spéciaux en toute sécurité

Pourquoi les caractères &lt; &gt; &amp; doivent être échappés, et comment cela évite de casser le balisage.

JWT : structure du token et ce que signifie « décoder » un JWT

Le header, le payload et la signature d'un JWT, et pourquoi décoder n'est pas la même chose que vérifier la signature.

Unicode Escape : que signifient les séquences \uXXXX

D'où viennent les séquences du type \u0041 dans le JSON et les chaînes JS, et ce qu'elles signifient.

ROT13 et le chiffre de César : une simple substitution de caractères

Pourquoi un décalage de 13 lettres rend ROT13 auto-inverse, et pourquoi on l'utilise encore aujourd'hui.

Punycode : comment les domaines internationalisés fonctionnent dans le DNS

Comment un domaine avec des caractères non latins devient une forme ASCII avec le préfixe xn--.

Le morse : comment le texte devient des points et des traits

Le principe de l'encodage des lettres en points et traits, et où le morse est encore utilisé aujourd'hui.

Data URI : quand intégrer une image directement dans le code

Comment un Data URI intègre le contenu d'un fichier directement en HTML ou CSS, et quand cela en vaut la peine.

Gzip + Base64 : compresser des données pour les transmettre en texte

Pourquoi des données binaires compressées sont aussi encodées en Base64 avant d'être placées dans un champ texte.