एन्कोडिंग

XML Entities Encode/Decode

XML एंटिटीज़ एन्कोडिंग और डिकोडिंग — 5 स्टैंडर्ड एंटिटीज़ (एम्परसेंड, एंगल ब्रैकेट्स, एपॉस्ट्रॉफी, कोट्स) और न्यूमेरिक कैरेक्टर रेफरेंस।

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

इस टूल के बारे में लेख: XML Entities: XML दस्तावेज़ों में वर्णों को एस्केप करना

अक्सर पूछे जाने वाले प्रश्न

XML में सिर्फ़ 5 एंटिटीज़ प्रीडिफ़ाइन क्यों हैं?

XML स्पेसिफिकेशन जानबूझकर छोटी और सख़्त रखी गई है, इसलिए सिर्फ़ &lt;, &gt;, &amp;, &apos; और &quot; पहले से डिफ़ाइन हैं — HTML के उलट, जिसमें सैकड़ों नेम्ड एंटिटीज़ (जैसे &copy;) होती हैं जो XML में मान्य नहीं हैं।

बाकी स्पेशल कैरेक्टर्स XML में कैसे लिखे जाते हैं?

उन्हें न्यूमेरिक कैरेक्टर रेफ़रेंस से दिखाया जाता है, जैसे &#169; या &#xA9;, जो किसी भी यूनिकोड कोड पॉइंट को डेसिमल या हेक्साडेसिमल फ़ॉर्म में दर्शा सकते हैं।

क्या मेरा XML/टेक्स्ट कहीं भेजा जाता है?

नहीं, एन्कोडिंग और डिकोडिंग पूरी तरह ब्राउज़र में होती है, सर्वर पर कुछ नहीं भेजा जाता।

CDATA क्या है और इसे एंटिटीज़ की बजाय कब इस्तेमाल करना चाहिए?

&lt;![CDATA[...]]&gt; सेक्शन बिना < और & को एस्केप किए टेक्स्ट का कोई ब्लॉक डालने देता है — यह XML के अंदर कोड या HTML के बड़े हिस्सों के लिए सुविधाजनक है। अपवाद है ]]> सीक्वेंस, जो CDATA को बंद कर देता है और खुद सामग्री में नहीं आ सकता।

क्या सभी XML पार्सर अमान्य एंटिटीज़ को एक जैसा हैंडल करते हैं?

नहीं, और ब्राउज़र के उलट, जो HTML की गलतियों को "माफ़" कर देते हैं, XML पार्सर सख़्त होते हैं: एक भी बिना एस्केप किया गया एम्परसेंड या कोणीय कोष्ठक पूरे दस्तावेज़ को अमान्य बना देता है, और प्रोसेसिंग एरर के साथ रुक जाती है।

लेख: एन्कोडिंग

Base64: एन्कोडिंग किस लिए है और यह कैसे काम करता है

Base64 बाइनरी डेटा को ASCII टेक्स्ट में कैसे बदलता है और यह वास्तव में कब ज़रूरी होता है।

Base32: यह Base64 से कैसे अलग है और कब ज़्यादा सुविधाजनक है

Base32 की केस-असंवेदनशील वर्णमाला और वे मामले जहाँ यह Base64 से ज़्यादा सुविधाजनक है।

URL Encode/Decode: लिंक में percent-encoding

पतों और पैरामीटर में विशेष वर्ण %XX अनुक्रमों में कैसे बदलते हैं।

HTML Entities: विशेष वर्णों को सुरक्षित रूप से कैसे दिखाएँ

&lt; &gt; &amp; वर्णों को एस्केप करना क्यों ज़रूरी है और यह मार्कअप को टूटने से कैसे बचाता है।

JWT: टोकन की संरचना और JWT को "डिकोड" करने का क्या मतलब है

JWT के header, payload और signature, और डिकोड करना सिग्नेचर सत्यापन जैसा क्यों नहीं है।

Unicode Escape: \uXXXX अनुक्रमों का क्या मतलब है

JSON और JS स्ट्रिंग में \u0041 जैसे अनुक्रम कहाँ से आते हैं और इनका क्या मतलब है।

ROT13 और सीज़र सिफर: वर्णों की सरल अदला-बदली

13 अक्षरों का शिफ्ट ROT13 को स्व-व्युत्क्रम क्यों बनाता है, और आज इसे क्यों इस्तेमाल किया जाता है।

Punycode: DNS में अंतरराष्ट्रीय डोमेन कैसे काम करते हैं

गैर-लैटिन वर्णों वाला डोमेन xn-- उपसर्ग वाले ASCII रूप में कैसे बदलता है।

मोर्स कोड: टेक्स्ट बिंदुओं और डैश में कैसे बदलता है

अक्षरों को बिंदुओं और डैश में एन्कोड करने का सिद्धांत, और आज मोर्स कोड कहाँ इस्तेमाल होता है।

Data URI: छवियों को सीधे कोड में कब एम्बेड करें

Data URI किसी फ़ाइल की सामग्री को सीधे HTML या CSS में कैसे एम्बेड करता है, और यह कब उचित है।

Gzip + Base64: डेटा को टेक्स्ट के रूप में भेजने के लिए संपीड़न

संपीड़ित बाइनरी डेटा को टेक्स्ट फ़ील्ड में डालने से पहले Base64 में क्यों एन्कोड किया जाता है।