Codifica

XML Entities Encode/Decode

Codifica e decodifica di entità XML — le 5 standard (e commerciale, parentesi angolari, apostrofo, virgolette) e riferimenti numerici ai caratteri.

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

Articolo su questo strumento: XML Entities: escapare i caratteri nei documenti XML

Domande frequenti

Quali sono le 5 entità XML predefinite?

XML predefinisce solo cinque entità nominate: &amp; (e commerciale), &lt; e &gt; (parentesi angolari), &apos; (apostrofo) e &quot; (virgolette). Tutto il resto richiede un riferimento numerico di carattere.

In cosa differisce dalla codifica delle entità HTML?

HTML definisce un insieme molto più ampio di entità nominate (come &nbsp; o &copy;), mentre l'XML rigoroso riconosce solo le cinque predefinite — qualsiasi altro carattere speciale in XML deve usare un riferimento numerico come &#169; o &#xA9;.

Quando devo eseguire l'escape delle entità XML?

Esegui l'escape di caratteri come < > & ' " ogni volta che compaiono nel contenuto testuale o nei valori degli attributi di un documento XML, così il parser non li scambia per markup e non fallisce l'analisi del file.

Cos'è CDATA e quando usarla al posto delle entità?

La sezione &lt;![CDATA[...]]&gt; permette di inserire un blocco di testo senza escape di < e & — comoda per grandi frammenti di codice o HTML dentro un XML. L'eccezione è la sequenza ]]>, che chiude la CDATA e non può comparire nel contenuto stesso.

I parser XML gestiscono le entità non valide tutti allo stesso modo?

No, e a differenza dei browser, che "perdonano" gli errori in HTML, i parser XML sono rigorosi: una sola & o parentesi angolare non escapata rende invalido l'intero documento, e l'elaborazione si interrompe con un errore.

Articoli: Codifica

Base64: a cosa serve la codifica e come funziona

Come Base64 trasforma dati binari in testo ASCII e quando serve davvero.

Base32: come si differenzia da Base64 e quando è più comodo

L'alfabeto di Base32, insensibile a maiuscole/minuscole, e i casi in cui è più comodo di Base64.

URL Encode/Decode: il percent-encoding nei link

Come i caratteri speciali negli indirizzi e nei parametri diventano sequenze %XX.

HTML Entities: come mostrare caratteri speciali in sicurezza

Perché i caratteri &lt; &gt; &amp; vanno escapati e come questo evita di rompere il markup.

JWT: struttura del token e cosa significa "decodificare" un JWT

Header, payload e signature di un JWT, e perché decodificare non equivale a verificare la firma.

Unicode Escape: cosa significano le sequenze \uXXXX

Da dove vengono sequenze come \u0041 in JSON e nelle stringhe JS, e cosa significano.

ROT13 e il cifrario di Cesare: semplice sostituzione di caratteri

Perché uno scorrimento di 13 lettere rende ROT13 auto-inverso, e perché si usa ancora oggi.

Punycode: come funzionano i domini internazionalizzati nel DNS

Come un dominio con caratteri non latini diventa una forma ASCII con il prefisso xn--.

Il codice Morse: come il testo diventa punti e linee

Il principio di codifica delle lettere in punti e linee, e dove si usa ancora oggi il Morse.

Data URI: quando incorporare immagini direttamente nel codice

Come un Data URI incorpora il contenuto di un file direttamente in HTML o CSS, e quando conviene.

Gzip + Base64: comprimere dati per trasmetterli come testo

Perché i dati binari compressi vengono anche codificati in Base64 prima di finire in un campo di testo.