Kodlama

Unicode Escape

Unicode dizilerini kodlama ve çözme — karakterleri \uXXXX biçiminde ve tersi.

A Unicode escape sequence (\uXXXX) writes a character as its code point instead of the character itself — so a string literal in code can contain any Unicode character while the source file itself stays plain ASCII.

How to use it

Common uses

Things to keep in mind

\uXXXX encodes exactly one 16-bit UTF-16 unit, not one visible character — characters outside the Basic Multilingual Plane (most emoji) need two such sequences together (a surrogate pair).

JSON only requires escaping for control characters and a few special characters — escaping every character as \uXXXX isn't required, though it is valid.

Bu araç hakkında makale: Unicode Escape: \uXXXX dizileri ne anlama gelir

Sıkça sorulan sorular

Bir \uXXXX kaçış dizisi neyi temsil eder?

Dört onaltılık basamak olarak yazılan bir Unicode kod noktasıdır; JSON, JavaScript dizeleri ve benzer biçimlerde bir karakteri doğrudan yazmadan temsil etmek için kullanılır.

Emoji gibi bazı karakterler neden iki \u dizisine dönüşür?

Temel Çok Dilli Düzlem dışındaki karakterler (çoğu emoji dahil astral karakterler) tek bir 16 bit'lik \uXXXX birimine sığmaz, bu yüzden bir vekil çift olarak temsil edilirler — birlikte tek bir karakteri kodlayan iki \uXXXX dizisi.

"ASCII olmayan" ve "Tüm karakterler" modu arasındaki fark nedir?

"ASCII olmayan" yalnızca temel ASCII aralığı dışındaki karakterleri kaçırır, düz harfleri, rakamları ve noktalama işaretlerini dokunulmadan bırakır. "Tüm karakterler" ASCII dahil her şeyi kaçırır, bu da tam karakter içeriğini görmek için yararlı olabilir.

Bir vekil çift ikiye bölünürse ne olur?

Geçersiz bir "yetim" karakter ortaya çıkar — eşleşmeyen, yalnız kalan bir kod. Çoğu ayrıştırıcı böyle bir dizeyi ya hatayla reddeder ya da yerine "�" karakterini gösterir.

Bir emoji karakteri tek bir \uXXXX ile kodlanabilir mi?

Hayır, emoji temel çok dilli düzlemin dışındaysa (ve günümüz emojilerinin çoğu tam olarak böyledir) — bunun için her zaman iki \uXXXX dizisinden oluşan bir vekil çift gerekir.

Makaleler: Kodlama

Base64: kodlama neden gerekli ve nasıl çalışır

Base64 ikili verileri ASCII metnine nasıl çevirir ve buna gerçekten ne zaman ihtiyaç duyulur.

Base32: Base64'ten farkı ve ne zaman daha kullanışlı

Büyük/küçük harf duyarsız Base32 alfabesi ve Base64'ten daha kullanışlı olduğu durumlar.

URL Encode/Decode: bağlantılarda percent-encoding

Adreslerdeki ve parametrelerdeki özel karakterlerin %XX dizilerine nasıl dönüştüğü.

HTML Entities: özel karakterleri güvenle nasıl gösterirsiniz

< > & karakterlerinin neden escape edilmesi gerektiği ve bunun bozuk işaretlemeyi nasıl önlediği.

JWT: token yapısı ve bir JWT'yi "çözmek" ne anlama gelir

Bir JWT'nin header, payload ve signature bölümleri ile çözmenin imza doğrulamayla aynı şey olmadığı.

ROT13 ve Sezar şifresi: basit karakter değişimi

13 harflik kaydırmanın ROT13'ü neden kendi kendine ters yapan bir işlem haline getirdiği ve hâlâ neden kullanıldığı.

Punycode: uluslararasılaştırılmış alan adları DNS'te nasıl çalışır

Latin olmayan karakterler içeren bir alan adının xn-- önekli ASCII formuna nasıl dönüştüğü.

Mors alfabesi: metin nokta ve çizgilere nasıl dönüşür

Harfleri nokta ve çizgilerle kodlama prensibi ve Mors alfabesinin günümüzde nerede kullanıldığı.

Data URI: görselleri doğrudan koda ne zaman gömmeli

Bir Data URI'nin bir dosyanın içeriğini doğrudan HTML veya CSS içine nasıl gömdüğü ve ne zaman buna değdiği.

Gzip + Base64: veriyi metin olarak iletmek için sıkıştırma

Sıkıştırılmış ikili verilerin bir metin alanına konmadan önce neden ayrıca Base64 ile kodlandığı.

XML Entities: XML belgelerinde karakter escape etme

Kendileri olmadan belgenin ayrıştırma sırasında bozulduğu beş zorunlu XML entity.