الترميز

Unicode Escape

ترميز وفك ترميز متتاليات Unicode — الأحرف بصيغة \uXXXX والعكس.

A Unicode escape sequence (\uXXXX) writes a character as its code point instead of the character itself — so a string literal in code can contain any Unicode character while the source file itself stays plain ASCII.

How to use it

Common uses

Things to keep in mind

\uXXXX encodes exactly one 16-bit UTF-16 unit, not one visible character — characters outside the Basic Multilingual Plane (most emoji) need two such sequences together (a surrogate pair).

JSON only requires escaping for control characters and a few special characters — escaping every character as \uXXXX isn't required, though it is valid.

مقالة عن هذه الأداة: Unicode Escape: ماذا تعني تسلسلات \uXXXX

الأسئلة الشائعة

ما هي صيغة \uXXXX؟

هي طريقة لكتابة حرف Unicode باستخدام رمزه السداسي عشري المكوّن من 4 خانات مسبوقًا بـ \u، وتُستخدم غالبًا في نصوص JavaScript وJSON لتمثيل أحرف غير ASCII بشكل آمن داخل سلسلة نصية.

لماذا يظهر رمزان \uXXXX لبعض الإيموجي أو الأحرف النادرة بدلًا من رمز واحد؟

لأن هذه الأحرف تقع خارج المستوى الأساسي متعدد اللغات (BMP)، فتُمثَّل في UTF-16 بزوج من الوحدات يسمى surrogate pair — رمزان \uXXXX متتاليان يمثلان حرفًا واحدًا فعليًا.

ما الفرق بين وضعي "غير ASCII" و"جميع الأحرف"؟

وضع "غير ASCII" يرمّز فقط الأحرف خارج نطاق ASCII القياسي ويترك الحروف والأرقام الإنجليزية كما هي، بينما وضع "جميع الأحرف" يحوّل كل حرف في النص، بما فيها ASCII، إلى صيغة \uXXXX.

ماذا يحدث إذا قُسِّم زوج بديل (surrogate pair) إلى نصفين؟

تنتج عن ذلك وحدة كود "يتيمة" غير صالحة — كود منفرد بلا نظير. معظم المحلّلات إما ترفض السلسلة بخطأ أو تعرض رمزًا بديلًا "�".

هل يمكن ترميز رمز إيموجي بصيغة \uXXXX واحدة؟

لا، إذا كان الإيموجي يقع خارج المستوى الأساسي متعدد اللغات (وهذا ينطبق على معظم الرموز التعبيرية الحديثة) — فهو يحتاج دائمًا إلى زوج بديل مكوّن من تسلسلي \uXXXX.

مقالات: الترميز

Base64: ما فائدة الترميز وكيف يعمل

كيف يحوّل Base64 البيانات الثنائية إلى نص ASCII، ومتى نحتاج ذلك فعلاً.

Base32: ما الفرق بينه وبين Base64 ومتى يكون أنسب

أبجدية Base32 التي لا تميّز بين حالة الأحرف، والحالات التي تكون فيها أنسب من Base64.

URL Encode/Decode: الترميز بالنسبة المئوية في الروابط

كيف تتحول الأحرف الخاصة في العناوين والمعاملات إلى تسلسلات %XX.

HTML Entities: كيف تعرض الأحرف الخاصة بأمان

لماذا يجب الهروب من الأحرف < > & وكيف يمنع ذلك تعطّل الترميز.

JWT: بنية الرمز وماذا يعني "فك ترميز" JWT

الأجزاء الثلاثة لرمز JWT، ولماذا فك الترميز ليس نفس التحقق من التوقيع.

ROT13 وشيفرة قيصر: استبدال بسيط للأحرف

لماذا تجعل إزاحة 13 حرفًا خوارزمية ROT13 عكسية ذاتيًا، ولماذا لا تزال تُستخدم اليوم.

Punycode: كيف تعمل النطاقات الدولية في DNS

كيف يتحول نطاق بأحرف غير لاتينية إلى صيغة ASCII تبدأ بالبادئة xn--.

شيفرة مورس: كيف يتحول النص إلى نقاط وشرطات

مبدأ ترميز الحروف كنقاط وشرطات، وأين لا تزال شيفرة مورس تُستخدم اليوم.

Data URI: متى تُضمَّن الصور مباشرة في الكود

كيف يضمّن Data URI محتوى الملف مباشرة في HTML أو CSS، ومتى يستحق ذلك العناء.

Gzip + Base64: ضغط البيانات لنقلها كنص

لماذا تُرمَّز البيانات الثنائية المضغوطة أيضًا بـ Base64 قبل وضعها في حقل نصي.

XML Entities: الهروب من الأحرف في مستندات XML

الكيانات الخمس الإلزامية في XML التي بدونها يتعطّل المستند أثناء التحليل.