メインコンテンツにスキップ

テキストを Unicode コードポイントに変換し、U+ 表記・\u エスケープ・HTML 数値文字参照をテキストに戻します。絵文字に対応し UTF-8 バイトも表示しますが、生の UTF-8 バイト列のデコードには対応しません。

Unicodeテキスト変換

文字の背後にあるコード ポイントとエスケープ表現を表示します。

中国語、絵文字、補助フラット文字、最大 4,000 コード ポイントをサポートします。

4 コード ポイント

変換結果

原文
你好 👋
Unicodeコードポイント
U+4F60 U+597D U+0020 U+1F44B
UTF-16エスケープ
\u4F60\u597D\u0020\uD83D\uDC4B
HTML 10 進エンティティ
你好 👋
UTF-8 バイト (16 進数)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
文字ごとに表示コード ポイントの数は、ビジュアル文字の数と等しくありません。
キャラクターコードポイントUTF-16HTMLエンティティ
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

使用説明書

  1. 「テキスト」→「Unicode」または「Unicode」→「テキスト」を選択します。
  2. 元のテキスト、U+ コード ポイント、\u エスケープ、または HTML 数値エンティティを入力します。
  3. 使用によって表現をコピーするか、すべての制御結果を一度にコピーします。

入力と出力の例

入力例
😀
出力例
コードポイント: U+1F600 UTF-16:\uD83D\uDE00 HTML:😀

コード ポイントでは 2 つの UTF-16 コード ユニットを使用できます。ビジュアル絵文字は複数のコード ポイントで構成される場合もあります。

よくある質問

できません。デコードは元の文字を復元するだけで、翻訳ではありません。例えば U+4F60 は元の中国語の文字に戻ります。

Unicode は文字にコード ポイントを割り当てます。 UTF-8 と UTF-16 は、これらのコード ポイントをエンコードする方法です。混乱を避けるために、コード ポイント、UTF-16 エスケープ、および UTF-8 バイトがここに示されています。

発音記号、肌の色調修飾子、家族の絵文字などを組み合わせると、複数のコード ポイントで構成される場合があります。このツールはコード ポイントをカウントしますが、視覚的な文字数としては扱いません。

現在、UTF-8 列にはバイトのみが表示されます。入力のデコードでは、コード ポイント、UTF-16 エスケープ、HTML 数値エンティティがサポートされます。元のバイトエンコーディングの自動推測は実行されません。最大 4,000 コード ポイントを変換します。

算出根拠と参考資料

Unicode コード ポイント、UTF-16 コード単位、および UTF-8 バイトを区別し、選択した表現に従って変換します。有効なサロゲート ペアがコード ポイントを形成します。コード結果ごとのコード ポイントは、人間の目で見えるグリフの数と等価ではありません。

内容チェック: · このサイトとコンテンツの説明について

関連ツール