Saltar al contenido principal

Codifica texto como puntos de código Unicode o decodifica notación U+, escapes \u y entidades HTML numéricas. Admite emoji y muestra bytes UTF-8; no decodifica bytes UTF-8 sin procesar.

Conversión de texto Unicode

Vea los puntos de código y las representaciones de escape detrás de los personajes.

Admite caracteres chinos, emoji y planos complementarios, hasta 4000 puntos de código.

EjemploPuntos de código 4

Resultado de la conversión

texto original
你好 👋
Punto de código Unicode
U+4F60 U+597D U+0020 U+1F44B
escape utf-16
\u4F60\u597D\u0020\uD83D\uDC4B
entidad decimal HTML
你好 👋
UTF-8 bytes (hexadecimales)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Ver personaje por personajeLa cantidad de puntos de código no es igual a la cantidad de caracteres visuales.
personajepunto de códigoUTF-16entidades HTML
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

Instrucciones de uso

  1. Seleccione Texto → Unicode o Unicode → Texto.
  2. Introduzca texto original, puntos de código U+, escapes \u o entidades numéricas HTML.
  3. Copie una representación por uso o copie todos los resultados de control a la vez.

Ejemplos de entrada y salida

Entrada de ejemplo
😀
Salida de ejemplo
Punto de código: U+1F600 UTF-16: \uD83D\uDE00 HTML: 😀

Un punto de código puede utilizar dos unidades de código UTF-16. Un emoji visual también puede estar compuesto por varios puntos de código.

Preguntas frecuentes

No. La decodificación recupera los caracteres originales; no traduce idiomas. Por ejemplo, U+4F60 sigue produciendo el carácter chino original.

Unicode asigna puntos de código a caracteres; UTF-8 y UTF-16 son formas de codificar estos puntos de código. Aquí se muestran los puntos de código, los escapes UTF-16 y los bytes UTF-8 para evitar confusiones.

La combinación de símbolos fonéticos, modificadores del tono de piel, emojis familiares, etc. puede estar compuesta por múltiples puntos de código. Esta herramienta cuenta puntos de código y no los trata como recuentos de caracteres visuales.

Actualmente, la columna UTF-8 solo muestra bytes. La entrada de decodificación admite puntos de código, escapes UTF-16 y entidades numéricas HTML; no se realiza ninguna adivinación automática de la codificación de bytes original. Convierta hasta 4000 puntos de código.

Bases de cálculo y materiales de referencia.

Distingue puntos de código Unicode, unidades de código UTF-16 y bytes UTF-8, convirtiendo según la representación seleccionada; los pares sustitutos válidos forman un punto de código. El resultado del código punto por código no es equivalente a la cantidad de glifos vistos por el ojo humano.

Verificación de contenido: · Acerca de este sitio y descripción del contenido

Herramientas relacionadas