Kodierung

XML Entities Encode/Decode

Kodierung und Dekodierung von XML-Entitäten — die 5 Standard-Entitäten (Et-Zeichen, spitze Klammern, Apostroph, Anführungszeichen) und numerische Zeichenreferenzen.

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

Artikel zu diesem Tool: XML Entities: Zeichen in XML-Dokumenten escapen

Häufig gestellte Fragen

Warum unterscheiden sich XML-Entities von HTML-Entities?

XML definiert von Haus aus nur fünf benannte Entitäten: lt, gt, amp, apos und quot. HTML kennt dagegen hunderte zusätzliche benannte Entitäten wie nbsp oder copy, die in reinem XML nicht ohne DTD funktionieren.

Wann brauche ich numerische statt benannte Zeichenreferenzen?

Für jedes Zeichen außerhalb der fünf XML-Standardentitäten, etwa Sonderzeichen oder Emojis, muss eine numerische Referenz wie &#8364; oder &#x20AC; verwendet werden, da XML dafür keine eigenen Namen definiert.

Wird der eingegebene XML-Inhalt an einen Server übertragen?

Nein, die Kodierung und Dekodierung erfolgt vollständig im Browser, ohne Datenübertragung an einen Server.

Was ist CDATA und wann nutzt man es statt Entities?

Der Abschnitt &lt;![CDATA[...]]&gt; erlaubt es, einen Textblock ohne Escaping von < und & einzufügen – praktisch für größere Code- oder HTML-Fragmente innerhalb von XML. Die Ausnahme ist die Sequenz ]]>, die den CDATA-Abschnitt schließt und im Inhalt selbst nicht vorkommen darf.

Behandeln alle XML-Parser ungültige Entities gleich?

Nein, und anders als Browser, die Fehler in HTML „verzeihen", sind XML-Parser streng: Ein einziges nicht escaptes Kaufmanns-Und oder eine spitze Klammer macht das gesamte Dokument ungültig, und die Verarbeitung bricht mit einem Fehler ab.

Artikel: Kodierung

Base64: wozu Kodierung dient und wie sie funktioniert

Wie Base64 binäre Daten in ASCII-Text verwandelt und wann das wirklich gebraucht wird.

Base32: der Unterschied zu Base64 und wann es praktischer ist

Das case-insensitive Alphabet von Base32 und Fälle, in denen es praktischer ist als Base64.

URL Encode/Decode: Percent-Encoding in Links

Wie Sonderzeichen in Adressen und Query-Parametern zu %XX-Sequenzen werden.

HTML Entities: Sonderzeichen sicher auf einer Seite ausgeben

Warum die Zeichen &lt; &gt; &amp; escapt werden müssen und wie das kaputtes Markup verhindert.

JWT: Aufbau eines Tokens und was „Dekodieren" eines JWT bedeutet

Header, Payload und Signature eines JWT — und warum Dekodieren nicht dasselbe ist wie Signaturprüfung.

Unicode Escape: was \uXXXX-Sequenzen bedeuten

Woher Sequenzen wie \u0041 in JSON und JS-Strings kommen und was sie bedeuten.

ROT13 und die Caesar-Verschlüsselung: einfache Zeichensubstitution

Warum eine Verschiebung um 13 Buchstaben ROT13 selbstinvers macht und wozu man es heute noch nutzt.

Punycode: wie internationalisierte Domains im DNS funktionieren

Wie eine Domain mit nicht-lateinischen Zeichen zu einer ASCII-Form mit dem Präfix xn-- wird.

Morsecode: wie Text zu Punkten und Strichen wird

Das Prinzip der Kodierung von Buchstaben als Punkte und Striche, und wo Morsecode heute noch genutzt wird.

Data URI: wann Bilder direkt in den Code einbetten

Wie ein Data-URI den Inhalt einer Datei direkt in HTML oder CSS einbettet, und wann sich das lohnt.

Gzip + Base64: Daten komprimieren für die Übertragung als Text

Warum komprimierte Binärdaten zusätzlich Base64-kodiert werden, bevor sie in ein Textfeld kommen.