Unicode 인코딩 규칙

짧은 텍스트를 입력하여 문자별로 Unicode 코드 포인트, 십진수 값, 소속 평면 및 UTF-8 바이트를 확인하고 코드 포인트 범위 빠른 참조도 유지합니다.

브라우저에서 로컬 처리
이 페이지는 공개 디렉터리 검사를 통과했습니다. JavaScript을 활성화하면 전체 기능을 사용할 수 있습니다.
사용 안내

Unicode 인코딩 규칙 사용 방법

Unicode 및 UTF-8 결과는 현재 브라우저에서만 계산되며 텍스트를 업로드하거나 저장하지 않습니다.

  1. 짧은 텍스트 입력

    최대 64개의 Unicode 스칼라 값을 입력할 수 있으며, 공백, 중복 문자 및 원래 순서를 모두 유지합니다.

  2. 코드 포인트 정보 보기

    문자별로 U+ 표기법, 십진수 코드 포인트, Unicode 평면 및 대문자 십육진수 UTF-8 바이트를 확인합니다.

  3. 범위 확인

    단일 문자 조회는 해당 코드 포인트 범위와 연동되며, TSV를 복사하거나 결과를 지울 수도 있습니다.

제한 및 주의사항

  • 도구는 Unicode 스칼라 값을 기준으로 분할하며, NFC, NFD 등의 정규화를 수행하지 않습니다. 결합 시퀀스는 여러 행으로 유지됩니다.
  • 서로게이트 항목 U+D800–U+DFFF은 Unicode 스칼라 값이 아닙니다. 고립된 서로게이트 항목은 유효한 문자 인코딩으로 처리되지 않습니다.
  • 코드 포인트와 UTF-8 바이트만으로는 글꼴에 반드시 글리프가 있다고 할 수 없으며, GBK, Big5 등의 레거시 인코딩 조회를 대체할 수도 없습니다.

자주 묻는 질문

Emoji 하나가 한 줄로만 표시되는데 왜 UTF-8 바이트인가요?

이 Emoji는 보충 평면의 Unicode 스칼라이며, UTF-8 이를 네 바이트 시퀀스로 나타냅니다.

겉보기에 동일한 문자가 왜 서로 다른 결과를 낼 수 있나요?

미리 조합된 문자와 기본 문자에 결합 표지를 추가한 문자는 비슷한 글리프로 표시될 수 있지만 서로 다른 Unicode 스칼라 시퀀스로 구성됩니다. 이 도구는 자동으로 정규화하지 않습니다.

U+ 뒤의 숫자는 어떤 진법인가요?

U+ 표기법은 십육진수를 사용하며, 페이지에는 상호 대조할 수 있도록 십진수 코드 포인트도 함께 표시됩니다.

페이지 피드백문제를 발견했거나 개선 제안이 있으신가요?
피드백 기능은 온라인 버전에서 사용해야 합니다

온라인 버전에서 JavaScript를 활성화한 후 제출해 주세요. 현재 도구나 사례의 로컬 기능에는 영향이 없습니다.

온라인 버전으로 피드백 보내기