Passa al contenuto principale

Codifica il testo in punti di codice Unicode o decodifica notazione U+, sequenze \u ed entità HTML numeriche. Supporta emoji e mostra i byte UTF-8; non decodifica byte UTF-8 grezzi.

Conversione di testo Unicode

Visualizza i punti di codice e le rappresentazioni di escape dietro i personaggi.

Supporta cinese, emoji e caratteri semplici supplementari, fino a 4.000 punti di codice.

EsempioPunti codice 4

Risultato della conversione

testo originale
你好 👋
Punto di codice Unicode
U+4F60 U+597D U+0020 U+1F44B
Fuga da UTF-16
\u4F60\u597D\u0020\uD83D\uDC4B
Entità decimale HTML
你好 👋
Byte UTF-8 (esadecimali)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Visualizza carattere per carattereIl numero di punti di codice non è uguale al numero di caratteri visivi.
caratterepunto di codiceUTF-16Entità HTML
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

Istruzioni per l'uso

  1. Seleziona Testo → Unicode o Unicode → Testo.
  2. Inserisci il testo originale, i punti di codice U+, gli escape \u o le entità numeriche HTML.
  3. Copia una rappresentazione in base all'uso o copia tutti i risultati del controllo contemporaneamente.

Esempi di input e output

Ingresso di esempio
😀
Uscita di esempio
Punto di codice: U+1F600 UTF-16: \uD83D\uDE00 HTML: 😀

Un punto di codice può utilizzare due unità di codice UTF-16. Un'emoji visiva può anche essere composta da più punti di codice.

Domande frequenti

No. La decodifica ripristina i caratteri originali senza tradurre la lingua. Ad esempio, U+4F60 restituisce ancora il carattere cinese originale.

Unicode assegna punti di codice ai caratteri; UTF-8 e UTF-16 sono modi per codificare questi punti di codice. I punti codice, gli escape UTF-16 e i byte UTF-8 vengono visualizzati qui per evitare confusione.

La combinazione di simboli fonetici, modificatori del tono della pelle, emoji familiari, ecc. può essere composta da più punti di codice. Questo strumento conta i punti di codice e non li tratta come conteggi di caratteri visivi.

Attualmente, la colonna UTF-8 visualizza solo byte. L'input di decodifica supporta punti di codice, escape UTF-16 ed entità numeriche HTML; non viene eseguita alcuna ipotesi automatica della codifica byte originale. Converti fino a 4.000 punti di codice.

Basi di calcolo e materiali di riferimento

Distingue i punti di codice Unicode, le unità di codice UTF-16 e i byte UTF-8, convertendoli in base alla rappresentazione selezionata; le coppie di surrogati validi formano un punto di codice. Il risultato del punto di codice per codice non è equivalente al numero di glifi visti dall'occhio umano.

Controllo del contenuto: · Informazioni su questo sito e descrizione dei contenuti

Strumenti correlati