Codifique texto em pontos de código Unicode ou decodifique notação U+, escapes \u e entidades HTML numéricas. Aceita emoji e exibe bytes UTF-8; bytes UTF-8 brutos não são aceitos como entrada de decodificação.
Veja os pontos de código e as representações de escape atrás dos caracteres.
Suporta chinês, emoji e caracteres simples complementares, até 4.000 pontos de código.
你好 👋
U+4F60 U+597D U+0020 U+1F44B
\u4F60\u597D\u0020\uD83D\uDC4B
你好 👋
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Um ponto de código pode usar duas unidades de código UTF-16. Um emoji visual também pode ser composto de vários pontos de código.
Não. A decodificação recupera os caracteres originais, sem traduzir idiomas. Por exemplo, U+4F60 continua sendo o caractere chinês original.
Unicode atribui pontos de código aos caracteres; UTF-8 e UTF-16 são formas de codificar esses pontos de código. Pontos de código, escapes UTF-16 e bytes UTF-8 são mostrados aqui para evitar confusão.
A combinação de símbolos fonéticos, modificadores de tom de pele, emojis familiares, etc. pode ser composta por vários pontos de código. Esta ferramenta conta pontos de código e não os trata como contagens de caracteres visuais.
Atualmente, a coluna UTF-8 exibe apenas bytes. A entrada de decodificação oferece suporte a pontos de código, escapes UTF-16 e entidades numéricas HTML; nenhuma adivinhação automática da codificação de bytes original é executada. Converta até 4.000 pontos de código.
Distingue pontos de código Unicode, unidades de código UTF-16 e bytes UTF-8, convertendo de acordo com a representação selecionada; pares substitutos válidos formam um ponto de código. O resultado ponto por código não é equivalente ao número de glifos vistos pelo olho humano.
Verificação de conteúdo:2026-09-08 · Sobre este site e descrição do conteúdo