Codificação

XML Entities Encode/Decode

Codificação e decodificação de entidades XML — as 5 padrão (e comercial, colchetes angulares, apóstrofo, aspas) e referências numéricas de caracteres.

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

Artigo sobre esta ferramenta: XML Entities: escapar caracteres em documentos XML

Perguntas frequentes

Quais são as 5 entidades XML predefinidas?

O XML predefine apenas cinco entidades nomeadas: &amp; (comercial), &lt; e &gt; (colchetes angulares), &apos; (apóstrofo) e &quot; (aspas). Qualquer coisa além disso precisa de uma referência numérica de caractere.

Em que isso difere da codificação de entidades HTML?

O HTML define um conjunto muito maior de entidades nomeadas (como &nbsp; ou &copy;), enquanto o XML estrito reconhece apenas as cinco predefinidas — qualquer outro caractere especial em XML deve usar uma referência numérica como &#169; ou &#xA9;.

Quando preciso escapar entidades XML?

Escape caracteres como < > & ' " sempre que aparecerem no conteúdo de texto ou em valores de atributo de um documento XML, para que o analisador não os confunda com marcação e falhe ao processar o arquivo.

O que é CDATA e quando usá-lo em vez de entidades?

A seção &lt;![CDATA[...]]&gt; permite inserir um bloco de texto sem escapar < e & — útil para grandes fragmentos de código ou HTML dentro de XML. A exceção é a sequência ]]>, que fecha o CDATA e não pode aparecer dentro do próprio conteúdo.

Os parsers XML tratam entidades inválidas da mesma forma?

Não, e ao contrário dos navegadores, que "perdoam" erros em HTML, os parsers XML são rígidos: um único & ou colchete angular não escapado torna todo o documento inválido, e o processamento é interrompido com erro.

Artigos: Codificação

Base64: para que serve a codificação e como funciona

Como o Base64 transforma dados binários em texto ASCII e quando isso é realmente necessário.

Base32: em que difere do Base64 e quando é mais prático

O alfabeto do Base32, que não diferencia maiúsculas de minúsculas, e os casos em que é mais prático que o Base64.

URL Encode/Decode: o percent-encoding em links

Como caracteres especiais em endereços e parâmetros se tornam sequências %XX.

HTML Entities: como exibir caracteres especiais com segurança

Por que os caracteres &lt; &gt; &amp; precisam ser escapados e como isso evita que a marcação quebre.

JWT: a estrutura do token e o que significa "decodificar" um JWT

O header, o payload e a signature de um JWT, e por que decodificar não é o mesmo que verificar a assinatura.

Unicode Escape: o que significam as sequências \uXXXX

De onde vêm sequências como \u0041 em JSON e strings JS, e o que significam.

ROT13 e a cifra de César: substituição simples de caracteres

Por que um deslocamento de 13 letras torna o ROT13 autoinverso, e por que ainda se usa hoje.

Punycode: como os domínios internacionalizados funcionam no DNS

Como um domínio com caracteres não latinos se torna uma forma ASCII com o prefixo xn--.

Código Morse: como o texto se transforma em pontos e traços

O princípio de codificar letras em pontos e traços, e onde o Morse ainda é usado hoje.

Data URI: quando incorporar imagens diretamente no código

Como um Data URI incorpora o conteúdo de um arquivo diretamente em HTML ou CSS, e quando vale a pena.

Gzip + Base64: comprimir dados para transmitir como texto

Por que dados binários comprimidos também são codificados em Base64 antes de irem para um campo de texto.