跳到主要內容

將文字編碼為 Unicode 碼點,或將 U+、\u 跳脫序列及 HTML 數字實體解碼為文字。支援中文和 emoji,並顯示 UTF-8 位元組;不接受原始 UTF-8 位元組作為解碼輸入。

Unicode 文字轉換

查看字元背後的碼點與轉義表示。

支援中文、emoji 與補充平面字符,最多 4,000 個碼點。

範例4 個碼點

轉換結果

原始文字
你好 👋
Unicode 碼點
U+4F60 U+597D U+0020 U+1F44B
UTF-16 轉義
\u4F60\u597D\u0020\uD83D\uDC4B
HTML 十進位實體
你好 👋
UTF-8 位元組(十六進位)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
逐字符查看碼點數量不等於視覺字元數量。
字元碼點UTF-16HTML 實體
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

使用說明

  1. 選擇「文字 → Unicode」或「Unicode → 文字」。
  2. 輸入原文、U+ 碼點、\u 轉義或 HTML 數字實體。
  3. 以用途複製某種表示,或一次複製全部對照結果。

輸入與輸出範例

範例輸入
😀
範例輸出
碼點:U+1F600 UTF-16:\uD83D\uDE00 HTML:😀

一個碼點可以使用兩個 UTF-16 代碼單元。視覺上的一個 emoji 也可能由多個碼點組合。

常見問題

不能。解碼只還原原本的字元,不翻譯語言。例如 U+4F60 解碼後仍是「你」。

Unicode 給字元分配碼點;UTF-8 和 UTF-16 是編碼這些碼點的方式。這裡分別展示碼點、UTF-16 轉義和 UTF-8 字節,避免混淆。

組合音標、膚色修飾符和家庭 emoji 等可能由多個碼點組成。本工具統計碼點,不把它當作視覺字元數。

目前 UTF-8 一欄只做位元組展示。解碼輸入支援碼點、UTF-16 轉義和 HTML 數字實體;不自動猜測原始位元組編碼。最多轉換 4,000 個碼點。

計算依據與參考資料

區分 Unicode 碼點、UTF-16 代碼單元與 UTF-8 字節,依所選表示轉換;有效代理對會組成一個碼點。逐碼點結果不等於人眼看到的字形數。

內容核對: · 關於本站與內容說明

相關工具