Pular para o conteúdo principal

Codifique texto em pontos de código Unicode ou decodifique notação U+, escapes \u e entidades HTML numéricas. Aceita emoji e exibe bytes UTF-8; bytes UTF-8 brutos não são aceitos como entrada de decodificação.

Conversão de texto Unicode

Veja os pontos de código e as representações de escape atrás dos caracteres.

Suporta chinês, emoji e caracteres simples complementares, até 4.000 pontos de código.

ExemploPontos de código 4

Resultado da conversão

texto original
你好 👋
Ponto de código Unicode
U+4F60 U+597D U+0020 U+1F44B
Fuga UTF-16
\u4F60\u597D\u0020\uD83D\uDC4B
Entidade decimal HTML
你好 👋
Bytes UTF-8 (hexadecimal)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Veja personagem por personagemO número de pontos de código não é igual ao número de caracteres visuais.
personagemponto de códigoUTF-16Entidades HTML
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

Instruções de uso

  1. Selecione Texto → Unicode ou Unicode → Texto.
  2. Insira o texto original, pontos de código U+, escapes \u ou entidades numéricas HTML.
  3. Copie uma representação por uso ou copie todos os resultados de controle de uma só vez.

Exemplos de entrada e saída

Entrada de exemplo
😀
Exemplo de saída
Ponto de código: U+1F600 UTF-16: \uD83D\uDE00 HTML: 😀

Um ponto de código pode usar duas unidades de código UTF-16. Um emoji visual também pode ser composto de vários pontos de código.

Perguntas frequentes

Não. A decodificação recupera os caracteres originais, sem traduzir idiomas. Por exemplo, U+4F60 continua sendo o caractere chinês original.

Unicode atribui pontos de código aos caracteres; UTF-8 e UTF-16 são formas de codificar esses pontos de código. Pontos de código, escapes UTF-16 e bytes UTF-8 são mostrados aqui para evitar confusão.

A combinação de símbolos fonéticos, modificadores de tom de pele, emojis familiares, etc. pode ser composta por vários pontos de código. Esta ferramenta conta pontos de código e não os trata como contagens de caracteres visuais.

Atualmente, a coluna UTF-8 exibe apenas bytes. A entrada de decodificação oferece suporte a pontos de código, escapes UTF-16 e entidades numéricas HTML; nenhuma adivinhação automática da codificação de bytes original é executada. Converta até 4.000 pontos de código.

Base de cálculo e materiais de referência

Distingue pontos de código Unicode, unidades de código UTF-16 e bytes UTF-8, convertendo de acordo com a representação selecionada; pares substitutos válidos formam um ponto de código. O resultado ponto por código não é equivalente ao número de glifos vistos pelo olho humano.

Verificação de conteúdo: · Sobre este site e descrição do conteúdo

Ferramentas relacionadas