การเข้ารหัส

XML Entities Encode/Decode

เข้ารหัสและถอดรหัส XML entities — 5 แบบมาตรฐาน (แอมเปอร์แซนด์ วงเล็บมุม อะพอสทรอฟี เครื่องหมายคำพูด) และการอ้างอิงอักขระเชิงตัวเลข

Unlike HTML, XML strictly requires escaping five special characters (&, <, >, ', "), or the document is considered invalid. This tool encodes and decodes those entities, as well as numeric character references.

How to use it

Common uses

Things to keep in mind

XML parsers are much stricter than HTML: a single unescaped entity invalidates the entire document, not just one element.

CDATA sections (<![CDATA[...]]>) are an alternative to escaping for large blocks of text, letting you insert arbitrary content without replacing every special character individually.

บทความเกี่ยวกับเครื่องมือนี้: XML Entities: การ escape อักขระในเอกสาร XML

คำถามที่พบบ่อย

เอนทิตี XML ที่กำหนดไว้ล่วงหน้า 5 ตัวคืออะไร?

XML กำหนดเอนทิตีแบบชื่อไว้ล่วงหน้าเพียงห้าตัวเท่านั้น: &amp; (แอมเปอร์แซนด์), &lt; และ &gt; (วงเล็บมุม), &apos; (อะพอสทรอฟี) และ &quot; (เครื่องหมายคำพูด) นอกเหนือจากนี้ต้องใช้การอ้างอิงอักขระแบบตัวเลขแทน

สิ่งนี้ต่างจากการเข้ารหัสเอนทิตี HTML อย่างไร?

HTML กำหนดชุดเอนทิตีแบบชื่อที่ใหญ่กว่ามาก (เช่น &nbsp; หรือ &copy;) ในขณะที่ XML ที่เข้มงวดรู้จักเพียงห้าตัวที่กำหนดไว้ล่วงหน้าเท่านั้น อักขระพิเศษอื่นใดใน XML ต้องใช้การอ้างอิงตัวเลขอย่าง &#169; หรือ &#xA9;

เมื่อไหร่ที่ต้องหลีกเอนทิตี XML?

หลีกอักขระอย่าง < > & ' " ทุกครั้งที่ปรากฏในเนื้อหาข้อความหรือค่าแอตทริบิวต์ของเอกสาร XML เพื่อไม่ให้ตัวแยกวิเคราะห์เข้าใจผิดว่าเป็นมาร์กอัปและแปลไฟล์ไม่สำเร็จ

CDATA คืออะไร และควรใช้แทนเอนทิตีเมื่อไหร่?

ส่วน &lt;![CDATA[...]]&gt; ช่วยให้แทรกบล็อกข้อความโดยไม่ต้อง escape < และ & ได้ — สะดวกสำหรับส่วนของโค้ดหรือ HTML ขนาดใหญ่ภายใน XML ข้อยกเว้นคือลำดับ ]]> ซึ่งใช้ปิด CDATA และไม่สามารถปรากฏอยู่ในเนื้อหาเองได้

ตัวแยกวิเคราะห์ XML จัดการเอนทิตีที่ไม่ถูกต้องเหมือนกันทุกตัวหรือไม่?

ไม่ และต่างจากเบราว์เซอร์ที่ "ให้อภัย" ข้อผิดพลาดใน HTML ตัวแยกวิเคราะห์ XML เข้มงวด: เครื่องหมาย & หรือวงเล็บมุมที่ไม่ได้ escape เพียงตัวเดียวก็ทำให้เอกสารทั้งหมดไม่ถูกต้อง และการประมวลผลจะหยุดลงพร้อมข้อผิดพลาด

บทความ: การเข้ารหัส

Base64: การเข้ารหัสมีไว้ทำไมและทำงานอย่างไร

Base64 เปลี่ยนข้อมูลไบนารีเป็นข้อความ ASCII อย่างไร และเมื่อไหร่ที่จำเป็นต้องใช้จริง ๆ

Base32: ต่างจาก Base64 อย่างไรและสะดวกกว่าเมื่อไหร่

ตัวอักษร Base32 ที่ไม่แยกตัวพิมพ์เล็กใหญ่ และกรณีที่สะดวกกว่า Base64

URL Encode/Decode: percent-encoding ในลิงก์

อักขระพิเศษในที่อยู่และพารามิเตอร์กลายเป็นลำดับ %XX ได้อย่างไร

HTML Entities: วิธีแสดงอักขระพิเศษอย่างปลอดภัย

ทำไมต้อง escape อักขระ &lt; &gt; &amp; และสิ่งนี้ป้องกันไม่ให้มาร์กอัปเสียหายได้อย่างไร

JWT: โครงสร้างโทเคนและความหมายของการ "ถอดรหัส" JWT

header, payload และ signature ของ JWT และทำไมการถอดรหัสจึงไม่เหมือนกับการตรวจสอบลายเซ็น

Unicode Escape: ลำดับ \uXXXX หมายความว่าอย่างไร

ลำดับแบบ A ใน JSON และสตริง JS มาจากไหน และหมายความว่าอย่างไร

ROT13 และรหัสซีซาร์: การแทนที่อักขระแบบง่าย

ทำไมการเลื่อน 13 ตัวอักษรทำให้ ROT13 ผกผันในตัวเอง และทำไมยังมีการใช้อยู่ในปัจจุบัน

Punycode: โดเมนสากลทำงานใน DNS อย่างไร

โดเมนที่มีอักขระไม่ใช่ละตินกลายเป็นรูปแบบ ASCII ที่มีคำนำหน้า xn-- ได้อย่างไร

รหัสมอร์ส: ข้อความกลายเป็นจุดและขีดได้อย่างไร

หลักการเข้ารหัสตัวอักษรเป็นจุดและขีด และรหัสมอร์สยังใช้ที่ไหนอยู่บ้างในปัจจุบัน

Data URI: เมื่อไหร่ควรฝังรูปภาพลงในโค้ดโดยตรง

Data URI ฝังเนื้อหาของไฟล์ลงใน HTML หรือ CSS โดยตรงอย่างไร และเมื่อไหร่ที่คุ้มค่า

Gzip + Base64: บีบอัดข้อมูลเพื่อส่งเป็นข้อความ

ทำไมข้อมูลไบนารีที่บีบอัดแล้วจึงถูกเข้ารหัสด้วย Base64 อีกครั้งก่อนใส่ลงในฟิลด์ข้อความ