Преобразуйте текст в кодовые точки Unicode или декодируйте запись U+, последовательности \u и числовые HTML-сущности. Поддерживаются эмодзи и показ байтов UTF-8; декодирование сырых байтов UTF-8 не поддерживается.
Просмотрите кодовые точки и escape-представления позади символов.
Поддерживает китайский язык, эмодзи и дополнительные плоские символы, до 4000 кодовых точек.
你好 👋
U+4F60 U+597D U+0020 U+1F44B
\u4F60\u597D\u0020\uD83D\uDC4B
你好 👋
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
Кодовая точка может использовать две кодовые единицы UTF-16. Визуальный эмодзи также может состоять из нескольких кодовых точек.
Нет. Декодирование восстанавливает исходные символы, а не переводит язык. Например, U+4F60 по-прежнему даёт исходный китайский символ.
Unicode присваивает символам кодовые точки; UTF-8 и UTF-16 — это способы кодирования этих кодовых точек. Здесь показаны кодовые точки, escape-символы UTF-16 и байты UTF-8, чтобы избежать путаницы.
Сочетание фонетических символов, модификаторов тона кожи, семейных смайлов и т. д. может состоять из нескольких кодовых точек. Этот инструмент подсчитывает кодовые точки и не рассматривает их как подсчет визуальных символов.
В настоящее время столбец UTF-8 отображает только байты. Ввод декодирования поддерживает кодовые точки, escape-последовательности UTF-16 и числовые объекты HTML; автоматическое угадывание исходной кодировки байта не выполняется. Преобразование до 4000 кодовых точек.
Различает кодовые точки Unicode, кодовые единицы UTF-16 и байты UTF-8, преобразуя их в соответствии с выбранным представлением; допустимые суррогатные пары образуют кодовую точку. Результат поточечного кода не эквивалентен количеству глифов, видимых человеческим глазом.
Проверка содержимого:2026-09-08 · Об этом сайте и описании контента