Codifica
XML Entities Encode/Decode
Codifica e decodifica di entità XML — le 5 standard (e commerciale, parentesi angolari, apostrofo, virgolette) e riferimenti numerici ai caratteri.
Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.
How to use it
- Encode: paste text and the five reserved characters get replaced with their matching entities (&, <, >, ', ").
- Decode: paste XML containing entities to get plain text back.
- Numeric character references (& or &) are supported too, for characters outside the standard five.
Common uses
- Preparing user text for insertion into an XML document (an RSS feed, a SOAP request, a config file).
- Debugging why an XML parser rejects a document — often the cause is an unescaped ampersand or angle bracket inside the text.
- Decoding content received from an XML-based API to read it in its original form.
Things to keep in mind
XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.
CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.
Articolo su questo strumento: XML Entities: escapare i caratteri nei documenti XML
Domande frequenti
Quali sono le 5 entità XML predefinite?
XML predefinisce solo cinque entità nominate: & (e commerciale), < e > (parentesi angolari), ' (apostrofo) e " (virgolette). Tutto il resto richiede un riferimento numerico di carattere.
In cosa differisce dalla codifica delle entità HTML?
HTML definisce un insieme molto più ampio di entità nominate (come o ©), mentre l'XML rigoroso riconosce solo le cinque predefinite — qualsiasi altro carattere speciale in XML deve usare un riferimento numerico come © o ©.
Quando devo eseguire l'escape delle entità XML?
Esegui l'escape di caratteri come < > & ' " ogni volta che compaiono nel contenuto testuale o nei valori degli attributi di un documento XML, così il parser non li scambia per markup e non fallisce l'analisi del file.
Cos'è CDATA e quando usarla al posto delle entità?
La sezione <![CDATA[...]]> permette di inserire un blocco di testo senza escape di < e & — comoda per grandi frammenti di codice o HTML dentro un XML. L'eccezione è la sequenza ]]>, che chiude la CDATA e non può comparire nel contenuto stesso.
I parser XML gestiscono le entità non valide tutti allo stesso modo?
No, e a differenza dei browser, che "perdonano" gli errori in HTML, i parser XML sono rigorosi: una sola & o parentesi angolare non escapata rende invalido l'intero documento, e l'elaborazione si interrompe con un errore.