O português tem algo que nenhuma outra grande língua românica tem da mesma forma: vogais nasais marcadas com til, como em "não" e "põe". Cada uma dessas vogais — ã, õ — ocupa um ponto de código Unicode próprio, então cada uma vira exatamente um código de escape, como \u00e3.
Como fica uma frase em português escapada
Uma palavra como "amanhã" produz um código de escape a mais só para o "ã", que é um único ponto de código, não dois — não é "a" seguido de outro caractere. Isso costuma surpreender quem espera que apenas "letras estrangeiras" precisem ser escapadas.
JSON e as sequências de escape
A especificação JSON permite escapar qualquer caractere de uma string como \uXXXX. Isso é comum quando os dados são gerados automaticamente e o serializador evita caracteres fora do ASCII por compatibilidade — então, em vez de "informação", um JSON pode mostrar uma sequência de dez ou mais códigos de escape.
Quando isso é necessário
- Ler, em linguagem simples, qual texto está escondido atrás de sequências de escape numa resposta JSON de uma API.
- Preparar uma string para um ambiente que não aceita caracteres fora do ASCII.
- Diagnosticar problemas de codificação ao trabalhar com dados externos.
Caracteres fora do plano básico (emojis)
Tanto "ã" quanto "ç" cabem num único código de escape, porque estão dentro do plano multilíngue básico. Os emojis, por outro lado, ficam fora desse plano e no JavaScript são codificados com dois códigos — um par substituto como \ud83d\ude00 —, algo que nunca acontece com as letras próprias do português.