Codificação
XML Entities Encode/Decode
Codificação e decodificação de entidades XML — as 5 padrão (e comercial, colchetes angulares, apóstrofo, aspas) e referências numéricas de caracteres.
Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.
How to use it
- Encode: paste text and the five reserved characters get replaced with their matching entities (&, <, >, ', ").
- Decode: paste XML containing entities to get plain text back.
- Numeric character references (& or &) are supported too, for characters outside the standard five.
Common uses
- Preparing user text for insertion into an XML document (an RSS feed, a SOAP request, a config file).
- Debugging why an XML parser rejects a document — often the cause is an unescaped ampersand or angle bracket inside the text.
- Decoding content received from an XML-based API to read it in its original form.
Things to keep in mind
XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.
CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.
Artigo sobre esta ferramenta: XML Entities: escapar caracteres em documentos XML
Perguntas frequentes
Quais são as 5 entidades XML predefinidas?
O XML predefine apenas cinco entidades nomeadas: & (comercial), < e > (colchetes angulares), ' (apóstrofo) e " (aspas). Qualquer coisa além disso precisa de uma referência numérica de caractere.
Em que isso difere da codificação de entidades HTML?
O HTML define um conjunto muito maior de entidades nomeadas (como ou ©), enquanto o XML estrito reconhece apenas as cinco predefinidas — qualquer outro caractere especial em XML deve usar uma referência numérica como © ou ©.
Quando preciso escapar entidades XML?
Escape caracteres como < > & ' " sempre que aparecerem no conteúdo de texto ou em valores de atributo de um documento XML, para que o analisador não os confunda com marcação e falhe ao processar o arquivo.
O que é CDATA e quando usá-lo em vez de entidades?
A seção <![CDATA[...]]> permite inserir um bloco de texto sem escapar < e & — útil para grandes fragmentos de código ou HTML dentro de XML. A exceção é a sequência ]]>, que fecha o CDATA e não pode aparecer dentro do próprio conteúdo.
Os parsers XML tratam entidades inválidas da mesma forma?
Não, e ao contrário dos navegadores, que "perdoam" erros em HTML, os parsers XML são rígidos: um único & ou colchete angular não escapado torna todo o documento inválido, e o processamento é interrompido com erro.