एन्कोडिंग
XML Entities Encode/Decode
XML एंटिटीज़ एन्कोडिंग और डिकोडिंग — 5 स्टैंडर्ड एंटिटीज़ (एम्परसेंड, एंगल ब्रैकेट्स, एपॉस्ट्रॉफी, कोट्स) और न्यूमेरिक कैरेक्टर रेफरेंस।
Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.
How to use it
- Encode: paste text and the five reserved characters get replaced with their matching entities (&, <, >, ', ").
- Decode: paste XML containing entities to get plain text back.
- Numeric character references (& or &) are supported too, for characters outside the standard five.
Common uses
- Preparing user text for insertion into an XML document (an RSS feed, a SOAP request, a config file).
- Debugging why an XML parser rejects a document — often the cause is an unescaped ampersand or angle bracket inside the text.
- Decoding content received from an XML-based API to read it in its original form.
Things to keep in mind
XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.
CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.
इस टूल के बारे में लेख: XML Entities: XML दस्तावेज़ों में वर्णों को एस्केप करना
अक्सर पूछे जाने वाले प्रश्न
XML में सिर्फ़ 5 एंटिटीज़ प्रीडिफ़ाइन क्यों हैं?
XML स्पेसिफिकेशन जानबूझकर छोटी और सख़्त रखी गई है, इसलिए सिर्फ़ <, >, &, ' और " पहले से डिफ़ाइन हैं — HTML के उलट, जिसमें सैकड़ों नेम्ड एंटिटीज़ (जैसे ©) होती हैं जो XML में मान्य नहीं हैं।
बाकी स्पेशल कैरेक्टर्स XML में कैसे लिखे जाते हैं?
उन्हें न्यूमेरिक कैरेक्टर रेफ़रेंस से दिखाया जाता है, जैसे © या ©, जो किसी भी यूनिकोड कोड पॉइंट को डेसिमल या हेक्साडेसिमल फ़ॉर्म में दर्शा सकते हैं।
क्या मेरा XML/टेक्स्ट कहीं भेजा जाता है?
नहीं, एन्कोडिंग और डिकोडिंग पूरी तरह ब्राउज़र में होती है, सर्वर पर कुछ नहीं भेजा जाता।
CDATA क्या है और इसे एंटिटीज़ की बजाय कब इस्तेमाल करना चाहिए?
<![CDATA[...]]> सेक्शन बिना < और & को एस्केप किए टेक्स्ट का कोई ब्लॉक डालने देता है — यह XML के अंदर कोड या HTML के बड़े हिस्सों के लिए सुविधाजनक है। अपवाद है ]]> सीक्वेंस, जो CDATA को बंद कर देता है और खुद सामग्री में नहीं आ सकता।
क्या सभी XML पार्सर अमान्य एंटिटीज़ को एक जैसा हैंडल करते हैं?
नहीं, और ब्राउज़र के उलट, जो HTML की गलतियों को "माफ़" कर देते हैं, XML पार्सर सख़्त होते हैं: एक भी बिना एस्केप किया गया एम्परसेंड या कोणीय कोष्ठक पूरे दस्तावेज़ को अमान्य बना देता है, और प्रोसेसिंग एरर के साथ रुक जाती है।