Перейти к основному содержанию

Преобразуйте текст в кодовые точки Unicode или декодируйте запись U+, последовательности \u и числовые HTML-сущности. Поддерживаются эмодзи и показ байтов UTF-8; декодирование сырых байтов UTF-8 не поддерживается.

Преобразование текста в Юникоде

Просмотрите кодовые точки и escape-представления позади символов.

Поддерживает китайский язык, эмодзи и дополнительные плоские символы, до 4000 кодовых точек.

ПримерКодовые точки 4

Результат конвертации

исходный текст
你好 👋
Кодовая точка Юникода
U+4F60 U+597D U+0020 U+1F44B
Выход из UTF-16
\u4F60\u597D\u0020\uD83D\uDC4B
Десятичный объект HTML
你好 👋
UTF-8 байт (шестнадцатеричный)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Просмотр персонажа за персонажемКоличество кодовых точек не равно количеству визуальных символов.
персонажкодовая точкаUTF-16HTML-объекты
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

Инструкция по применению

  1. Выберите «Текст» → «Юникод» или «Юникод» → «Текст».
  2. Введите исходный текст, кодовые точки U+, escape-символы \u или числовые объекты HTML.
  3. Скопируйте представление по использованию или скопируйте все результаты управления одновременно.

Примеры ввода и вывода

Пример ввода
😀
Пример вывода
Кодовая точка: U+1F600. UTF-16: \uD83D\uDE00 HTML: 😀

Кодовая точка может использовать две кодовые единицы UTF-16. Визуальный эмодзи также может состоять из нескольких кодовых точек.

Часто задаваемые вопросы

Нет. Декодирование восстанавливает исходные символы, а не переводит язык. Например, U+4F60 по-прежнему даёт исходный китайский символ.

Unicode присваивает символам кодовые точки; UTF-8 и UTF-16 — это способы кодирования этих кодовых точек. Здесь показаны кодовые точки, escape-символы UTF-16 и байты UTF-8, чтобы избежать путаницы.

Сочетание фонетических символов, модификаторов тона кожи, семейных смайлов и т. д. может состоять из нескольких кодовых точек. Этот инструмент подсчитывает кодовые точки и не рассматривает их как подсчет визуальных символов.

В настоящее время столбец UTF-8 отображает только байты. Ввод декодирования поддерживает кодовые точки, escape-последовательности UTF-16 и числовые объекты HTML; автоматическое угадывание исходной кодировки байта не выполняется. Преобразование до 4000 кодовых точек.

Расчетная база и справочные материалы

Различает кодовые точки Unicode, кодовые единицы UTF-16 и байты UTF-8, преобразуя их в соответствии с выбранным представлением; допустимые суррогатные пары образуют кодовую точку. Результат поточечного кода не эквивалентен количеству глифов, видимых человеческим глазом.

Проверка содержимого: · Об этом сайте и описании контента

Сопутствующие инструменты