एन्कोडिंग

HTML Entities Encode/Decode

HTML एंटिटीज़ एन्कोडिंग और डिकोडिंग — पेज पर स्पेशल कैरेक्टर्स को सुरक्षित रूप से दिखाना।

HTML entities are a way to write characters that would otherwise break markup (<, >, &) or have no keyboard key, as safe text sequences like &lt; or &amp;. This tool encodes and decodes such entities right in your browser.

How to use it

Common uses

Things to keep in mind

HTML entity escaping only protects against XSS via a page's text content — it does not protect a JavaScript context (innerHTML, eval) or href/src attributes containing unvalidated URLs.

Encode exactly at the point where text gets inserted into HTML, not ahead of time when saving to a database — otherwise the data gets mangled when reused outside an HTML context.

इस टूल के बारे में लेख: HTML Entities: विशेष वर्णों को सुरक्षित रूप से कैसे दिखाएँ

अक्सर पूछे जाने वाले प्रश्न

HTML एंटिटीज़ की ज़रूरत क्यों पड़ती है?

ब्राउज़र <, >, & जैसे कैरेक्टर्स को मार्कअप का हिस्सा मान लेता है, इसलिए इन्हें टेक्स्ट के तौर पर सुरक्षित दिखाने के लिए एंटिटीज़ में एन्कोड करना पड़ता है — इससे न मार्कअप टूटता है, न कोई XSS जैसा रिस्क बनता है।

नेम्ड और न्यूमेरिक एंटिटी में क्या फ़र्क़ है?

नेम्ड एंटिटी (जैसे &amp;) पढ़ने में आसान होती है और सिर्फ़ कुछ जाने-पहचाने कैरेक्टर्स के लिए होती है, जबकि न्यूमेरिक (जैसे &#38; या &#x26;) किसी भी यूनिकोड कैरेक्टर को उसके कोड पॉइंट से दर्शा सकती है, चाहे उसका कोई नाम हो या न हो।

क्या इनपुट टेक्स्ट कहीं अपलोड होता है?

नहीं, एन्कोडिंग और डिकोडिंग पूरी तरह ब्राउज़र में होती है, सर्वर पर कुछ नहीं भेजा जाता।

क्या एट्रिब्यूट के अंदर टेक्स्ट को पेज के बॉडी से अलग तरीके से एस्केप करना पड़ता है?

मुख्य कैरेक्टर्स (<, >, &) एक जैसे ही एस्केप होते हैं, लेकिन उद्धरण चिह्नों वाले एट्रिब्यूट के अंदर उसी टाइप के उद्धरण चिह्न को एस्केप करना बहुत ज़रूरी है, जिससे एट्रिब्यूट बंद किया गया है — वरना मान उम्मीद से पहले "टूट" जाएगा।

क्या HTML एस्केपिंग हर तरह के XSS से बचाता है?

नहीं। यह सबसे आम वेक्टर — HTML कंटेंट में टेक्स्ट डालने — को रोकता है, लेकिन JavaScript कॉन्टेक्स्ट के ज़रिए होने वाले XSS (जैसे innerHTML के बाद कोड चलना) या href/src में बिना जांचे URL से नहीं बचाता।

लेख: एन्कोडिंग

Base64: एन्कोडिंग किस लिए है और यह कैसे काम करता है

Base64 बाइनरी डेटा को ASCII टेक्स्ट में कैसे बदलता है और यह वास्तव में कब ज़रूरी होता है।

Base32: यह Base64 से कैसे अलग है और कब ज़्यादा सुविधाजनक है

Base32 की केस-असंवेदनशील वर्णमाला और वे मामले जहाँ यह Base64 से ज़्यादा सुविधाजनक है।

URL Encode/Decode: लिंक में percent-encoding

पतों और पैरामीटर में विशेष वर्ण %XX अनुक्रमों में कैसे बदलते हैं।

JWT: टोकन की संरचना और JWT को "डिकोड" करने का क्या मतलब है

JWT के header, payload और signature, और डिकोड करना सिग्नेचर सत्यापन जैसा क्यों नहीं है।

Unicode Escape: \uXXXX अनुक्रमों का क्या मतलब है

JSON और JS स्ट्रिंग में \u0041 जैसे अनुक्रम कहाँ से आते हैं और इनका क्या मतलब है।

ROT13 और सीज़र सिफर: वर्णों की सरल अदला-बदली

13 अक्षरों का शिफ्ट ROT13 को स्व-व्युत्क्रम क्यों बनाता है, और आज इसे क्यों इस्तेमाल किया जाता है।

Punycode: DNS में अंतरराष्ट्रीय डोमेन कैसे काम करते हैं

गैर-लैटिन वर्णों वाला डोमेन xn-- उपसर्ग वाले ASCII रूप में कैसे बदलता है।

मोर्स कोड: टेक्स्ट बिंदुओं और डैश में कैसे बदलता है

अक्षरों को बिंदुओं और डैश में एन्कोड करने का सिद्धांत, और आज मोर्स कोड कहाँ इस्तेमाल होता है।

Data URI: छवियों को सीधे कोड में कब एम्बेड करें

Data URI किसी फ़ाइल की सामग्री को सीधे HTML या CSS में कैसे एम्बेड करता है, और यह कब उचित है।

Gzip + Base64: डेटा को टेक्स्ट के रूप में भेजने के लिए संपीड़न

संपीड़ित बाइनरी डेटा को टेक्स्ट फ़ील्ड में डालने से पहले Base64 में क्यों एन्कोड किया जाता है।

XML Entities: XML दस्तावेज़ों में वर्णों को एस्केप करना

पाँच अनिवार्य XML एंटिटी, जिनके बिना दस्तावेज़ पार्सिंग के दौरान टूट जाता है।