주요 콘텐츠로 건너뛰기

텍스트를 유니코드 코드 포인트로 변환하거나 U+ 표기, \u 이스케이프, HTML 숫자 엔티티를 텍스트로 디코딩합니다. 이모지를 지원하고 UTF-8 바이트를 표시하지만 원시 UTF-8 바이트의 디코딩은 지원하지 않습니다.

유니코드 텍스트 변환

문자 뒤에 있는 코드 포인트와 이스케이프 표현을 봅니다.

최대 4,000개의 코드 포인트까지 중국어, 이모티콘 및 보조 일반 문자를 지원합니다.

4 코드 포인트

변환 결과

원본 텍스트
你好 👋
유니코드 코드 포인트
U+4F60 U+597D U+0020 U+1F44B
UTF-16 이스케이프
\u4F60\u597D\u0020\uD83D\uDC4B
HTML 십진 엔터티
你好 👋
UTF-8 바이트(16진수)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
캐릭터별로 보기코드 포인트 수는 시각적 문자 수와 동일하지 않습니다.
성격코드 포인트UTF-16HTML 엔터티
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

사용 지침

  1. 텍스트 → 유니코드 또는 유니코드 → 텍스트를 선택합니다.
  2. 원본 텍스트, U+ 코드 포인트, \u 이스케이프 또는 HTML 숫자 엔터티를 입력하세요.
  3. 용도별로 표현을 복사하거나 모든 제어 결과를 한 번에 복사합니다.

입력 및 출력 예

입력 예
😀
예제 출력
코드 포인트: U+1F600 UTF-16: \uD83D\uDE00 HTML: 😀

코드 포인트는 두 개의 UTF-16 코드 단위를 사용할 수 있습니다. 시각적 이모티콘은 여러 코드 포인트로 구성될 수도 있습니다.

FAQ

아니요. 디코딩은 원래 문자를 복원할 뿐 언어를 번역하지 않습니다. 예를 들어 U+4F60은 원래 중국어 문자로 복원됩니다.

유니코드는 문자에 코드 포인트를 할당합니다. UTF-8 및 UTF-16은 이러한 코드 포인트를 인코딩하는 방법입니다. 혼동을 피하기 위해 코드 포인트, UTF-16 이스케이프 및 UTF-8 바이트가 여기에 표시됩니다.

발음 기호, 피부색 수정자, 가족 이모티콘 등을 결합하면 여러 코드 포인트로 구성될 수 있습니다. 이 도구는 코드 포인트를 계산하며 시각적 문자 수로 처리하지 않습니다.

현재 UTF-8 열에는 바이트만 표시됩니다. 디코딩 입력은 코드 포인트, UTF-16 이스케이프 및 HTML 숫자 엔터티를 지원합니다. 원래 바이트 인코딩에 대한 자동 추측은 수행되지 않습니다. 최대 4,000개의 코드 포인트를 변환합니다.

계산근거 및 참고자료

유니코드 코드 포인트, UTF-16 코드 단위 및 UTF-8 바이트를 구별하여 선택한 표현에 따라 변환합니다. 유효한 서로게이트 쌍이 코드 포인트를 형성합니다. 코드 결과별 코드 포인트는 사람의 눈으로 볼 수 있는 문자 수와 동일하지 않습니다.

내용 확인: · 이 사이트 및 콘텐츠 설명 정보

관련 도구