UTF-16 인코딩 표
짧은 텍스트를 입력하여 문자별로 UTF-16 코드 단위, BE/LE 바이트 및 BMP 또는 서로게이트 쌍 유형을 확인하고, 서로게이트 항목 범위 빠른 참조도 유지합니다.
브라우저에서 로컬 처리
이 페이지는 공개 디렉터리 검사를 통과했습니다. JavaScript을 활성화하면 전체 기능을 사용할 수 있습니다.
사용 안내
UTF-16 인코딩표 사용 방법
UTF-16 코드 단위와 바이트 순서 결과는 현재 브라우저에서만 계산되며 텍스트를 업로드하지 않습니다.
짧은 텍스트 입력
최대 64개의 Unicode 스칼라 값을 입력하면 도구가 원래 순서대로 문자별 처리합니다.
코드 단위 보기
각 문자를 단위로 하나의 BMP 코드 단위 또는 상위 서로게이트와 하위 서로게이트의 쌍, 그리고 이에 해당하는 UTF-16BE 및 UTF-16LE 바이트를 확인합니다.
서로게이트 항목 범위 확인
단일 문자 조회는 BMP 또는 대리 쌍 규칙과 연동되며, TSV를 복사하거나 입력 내용을 지울 수 있습니다.
제한 및 주의사항
- 바이트 열에는 지정된 엔디언의 코드 단위 바이트만 표시되며, BOM를 자동으로 추가하지 않고 파일 엔디언도 추론하지 않습니다.
- 보충 평면 스칼라는 두 개의 16비트 코드 단위를 사용합니다. 코드 단위 수를 사용자에게 보이는 문자 수로 직접 간주할 수는 없습니다.
- 고립된 상위 대리 항목 또는 하위 대리 항목은 유효한 Unicode 스칼라가 아니므로, 도구는 대체 바이트를 생성하지 않고 실패를 표시하며 종료됩니다.
자주 묻는 질문
Emoji에는 왜 UTF-16개의 코드 단위가 있나요?
U+10000 이상의 보충 평면 스칼라 값은 상위 서러게이트와 하위 서러게이트가 함께 표현해야 합니다.
UTF-16BE와 UTF-16LE는 왜 바이트 순서가 반대인가요?
둘 다 동일한 16비트 코드 단위를 나타내지만, 각 코드 단위의 상위 바이트와 하위 바이트를 저장하는 순서가 다릅니다.
페이지 출력에 BOM이 포함되나요?
아니요. 여기에는 개별 스칼라 값의 인코딩 바이트가 표시되며, 파일에 BOM이 필요한지는 구체적인 형식과 프로토콜에 따라 달라집니다.