Codificación

XML Entities Encode/Decode

Codificación y decodificación de entidades XML — las 5 estándar (ampersand, corchetes angulares, apóstrofo, comillas) y referencias numéricas de caracteres.

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

Artículo sobre esta herramienta: XML Entities: escapar caracteres en documentos XML

Preguntas frecuentes

¿En qué se diferencian las entidades XML de las entidades HTML?

XML solo define 5 entidades predefinidas: lt, gt, amp, apos y quot. HTML, en cambio, tiene un conjunto mucho más amplio de entidades con nombre (como &eacute; o &copy;). Fuera de esas 5, XML solo admite referencias numéricas de caracteres.

¿Cuándo debo usar la opción "Básicas" en vez de "Todos los caracteres"?

Básicas codifica solo los 5 caracteres imprescindibles para que el XML sea válido (&, <, >, ' y "). Todos los caracteres convierte además cualquier carácter fuera del ASCII básico a referencias numéricas, útil para máxima compatibilidad.

¿Se procesa el XML en un servidor?

No, la codificación y decodificación se ejecutan enteramente en tu navegador, sin enviar el contenido a ningún servidor.

¿Qué es CDATA y cuándo usarlo en vez de entidades?

La sección &lt;![CDATA[...]]&gt; permite insertar un bloque de texto sin escapar < ni &, útil para fragmentos grandes de código o HTML dentro de XML. La excepción es la secuencia ]]>, que cierra CDATA y no puede aparecer dentro del propio contenido.

¿Todos los analizadores XML tratan igual las entidades no válidas?

No, y a diferencia de los navegadores, que "perdonan" errores en HTML, los analizadores XML son estrictos: un solo ampersand o corchete angular sin escapar invalida todo el documento, y el procesamiento se detiene con un error.

Artículos: Codificación

Base64: para qué sirve la codificación y cómo funciona

Cómo Base64 convierte datos binarios en texto ASCII y cuándo esto realmente hace falta.

Base32: en qué se diferencia de Base64 y cuándo es más práctico

El alfabeto de Base32, que no distingue mayúsculas, y los casos donde resulta más práctico que Base64.

URL Encode/Decode: el percent-encoding en los enlaces

Cómo los caracteres especiales en direcciones y parámetros se convierten en secuencias %XX.

HTML Entities: cómo mostrar caracteres especiales de forma segura

Por qué hay que escapar los caracteres &lt; &gt; &amp; y cómo esto evita que el marcado se rompa.

JWT: la estructura del token y qué significa "decodificar" un JWT

El header, el payload y la signature de un token JWT, y por qué decodificar no es lo mismo que verificar la firma.

Unicode Escape: qué significan las secuencias \uXXXX

De dónde salen las secuencias tipo \u0041 en JSON y cadenas JS, y qué significan.

ROT13 y el cifrado César: sustitución simple de caracteres

Por qué un desplazamiento de 13 letras hace que ROT13 sea su propio inverso, y por qué se sigue usando hoy.

Punycode: cómo funcionan los dominios internacionalizados en el DNS

Cómo un dominio con caracteres no latinos se convierte en una representación ASCII con el prefijo xn--.

Código Morse: cómo el texto se convierte en puntos y rayas

El principio de codificar letras con puntos y rayas, y dónde se usa el código Morse hoy en día.

Data URI: cuándo incrustar imágenes directamente en el código

Cómo un Data URI incrusta el contenido de un archivo directamente en HTML o CSS, y cuándo vale la pena.

Gzip + Base64: comprimir datos para transmitirlos como texto

Por qué los datos binarios comprimidos también se codifican en Base64 antes de meterlos en un campo de texto.