UTF-16 인코딩 표

짧은 텍스트를 입력하여 문자별로 UTF-16 코드 단위, BE/LE 바이트 및 BMP 또는 서로게이트 쌍 유형을 확인하고, 서로게이트 항목 범위 빠른 참조도 유지합니다.

브라우저에서 로컬 처리
이 페이지는 공개 디렉터리 검사를 통과했습니다. JavaScript을 활성화하면 전체 기능을 사용할 수 있습니다.
사용 안내

UTF-16 인코딩표 사용 방법

UTF-16 코드 단위와 바이트 순서 결과는 현재 브라우저에서만 계산되며 텍스트를 업로드하지 않습니다.

  1. 짧은 텍스트 입력

    최대 64개의 Unicode 스칼라 값을 입력하면 도구가 원래 순서대로 문자별 처리합니다.

  2. 코드 단위 보기

    각 문자를 단위로 하나의 BMP 코드 단위 또는 상위 서로게이트와 하위 서로게이트의 쌍, 그리고 이에 해당하는 UTF-16BE 및 UTF-16LE 바이트를 확인합니다.

  3. 서로게이트 항목 범위 확인

    단일 문자 조회는 BMP 또는 대리 쌍 규칙과 연동되며, TSV를 복사하거나 입력 내용을 지울 수 있습니다.

제한 및 주의사항

  • 바이트 열에는 지정된 엔디언의 코드 단위 바이트만 표시되며, BOM를 자동으로 추가하지 않고 파일 엔디언도 추론하지 않습니다.
  • 보충 평면 스칼라는 두 개의 16비트 코드 단위를 사용합니다. 코드 단위 수를 사용자에게 보이는 문자 수로 직접 간주할 수는 없습니다.
  • 고립된 상위 대리 항목 또는 하위 대리 항목은 유효한 Unicode 스칼라가 아니므로, 도구는 대체 바이트를 생성하지 않고 실패를 표시하며 종료됩니다.

자주 묻는 질문

Emoji에는 왜 UTF-16개의 코드 단위가 있나요?

U+10000 이상의 보충 평면 스칼라 값은 상위 서러게이트와 하위 서러게이트가 함께 표현해야 합니다.

UTF-16BE와 UTF-16LE는 왜 바이트 순서가 반대인가요?

둘 다 동일한 16비트 코드 단위를 나타내지만, 각 코드 단위의 상위 바이트와 하위 바이트를 저장하는 순서가 다릅니다.

페이지 출력에 BOM이 포함되나요?

아니요. 여기에는 개별 스칼라 값의 인코딩 바이트가 표시되며, 파일에 BOM이 필요한지는 구체적인 형식과 프로토콜에 따라 달라집니다.

페이지 피드백문제를 발견했거나 개선 제안이 있으신가요?
피드백 기능은 온라인 버전에서 사용해야 합니다

온라인 버전에서 JavaScript를 활성화한 후 제출해 주세요. 현재 도구나 사례의 로컬 기능에는 영향이 없습니다.

온라인 버전으로 피드백 보내기