Unicode 인코딩 규칙
짧은 텍스트를 입력하여 문자별로 Unicode 코드 포인트, 십진수 값, 소속 평면 및 UTF-8 바이트를 확인하고 코드 포인트 범위 빠른 참조도 유지합니다.
브라우저에서 로컬 처리
이 페이지는 공개 디렉터리 검사를 통과했습니다. JavaScript을 활성화하면 전체 기능을 사용할 수 있습니다.
사용 안내
Unicode 인코딩 규칙 사용 방법
Unicode 및 UTF-8 결과는 현재 브라우저에서만 계산되며 텍스트를 업로드하거나 저장하지 않습니다.
짧은 텍스트 입력
최대 64개의 Unicode 스칼라 값을 입력할 수 있으며, 공백, 중복 문자 및 원래 순서를 모두 유지합니다.
코드 포인트 정보 보기
문자별로 U+ 표기법, 십진수 코드 포인트, Unicode 평면 및 대문자 십육진수 UTF-8 바이트를 확인합니다.
범위 확인
단일 문자 조회는 해당 코드 포인트 범위와 연동되며, TSV를 복사하거나 결과를 지울 수도 있습니다.
제한 및 주의사항
- 도구는 Unicode 스칼라 값을 기준으로 분할하며, NFC, NFD 등의 정규화를 수행하지 않습니다. 결합 시퀀스는 여러 행으로 유지됩니다.
- 서로게이트 항목 U+D800–U+DFFF은 Unicode 스칼라 값이 아닙니다. 고립된 서로게이트 항목은 유효한 문자 인코딩으로 처리되지 않습니다.
- 코드 포인트와 UTF-8 바이트만으로는 글꼴에 반드시 글리프가 있다고 할 수 없으며, GBK, Big5 등의 레거시 인코딩 조회를 대체할 수도 없습니다.
자주 묻는 질문
Emoji 하나가 한 줄로만 표시되는데 왜 UTF-8 바이트인가요?
이 Emoji는 보충 평면의 Unicode 스칼라이며, UTF-8 이를 네 바이트 시퀀스로 나타냅니다.
겉보기에 동일한 문자가 왜 서로 다른 결과를 낼 수 있나요?
미리 조합된 문자와 기본 문자에 결합 표지를 추가한 문자는 비슷한 글리프로 표시될 수 있지만 서로 다른 Unicode 스칼라 시퀀스로 구성됩니다. 이 도구는 자동으로 정규화하지 않습니다.
U+ 뒤의 숫자는 어떤 진법인가요?
U+ 표기법은 십육진수를 사용하며, 페이지에는 상호 대조할 수 있도록 십진수 코드 포인트도 함께 표시됩니다.