UTF-16 таблиця кодування
Введіть короткий текст, щоб переглядати для кожного символу кодові елементи UTF-16, байти BE/LE і тип BMP або сурогатної пари, зберігаючи швидкий довідник діапазонів сурогатів.
Як користуватися таблицею кодування UTF-16
UTF-16 Кодові одиниці та результати порядку байтів обчислюються лише в поточному браузері; текст не передається на сервер.
Введіть короткий текст
Введіть щонайбільше 64 значень скалярів Unicode; інструмент обробляє символи в початковому порядку.
Переглянути кодові одиниці
Переглядайте посимвольно одну BMP кодову одиницю або пару старшого й молодшого сурогатів, а також відповідні UTF-16BE і UTF-16LE байти.
Перевірити діапазон сурогатних елементів
Пошук одного символу пов’язаний із правилами BMP або сурогатних пар; можна скопіювати TSV або очистити введення.
Обмеження та зауваження
- У стовпці байтів відображаються лише байти кодових елементів у вказаному порядку байтів; BOM автоматично не додається, а порядок байтів файлу не визначається.
- Скалярні значення з додаткових площин використовують дві 16-розрядні кодові одиниці; кількість кодових одиниць не можна безпосередньо вважати кількістю видимих користувачеві символів.
- Ізольований старший або молодший сурогатний елемент не є дійсним скалярним значенням Unicode; інструмент завершить роботу з помилкою, а не згенерує байти-замінники.
Поширені запитання
Чому Emoji має два кодові елементи UTF-16?
Для скалярних значень додаткової площини, що перевищують U+10000, потрібні старша та молодша сурогатні одиниці, взяті разом.
Чому порядок байтів у UTF-16BE та UTF-16LE протилежний?
Обидва представляють ті самі 16-бітові кодові одиниці, відрізняється лише порядок зберігання старшого та молодшого байтів кожної кодової одиниці.
Чи міститиме виведення сторінки BOM?
Ні. Тут показано байти кодування окремого скаляра; потреба файлу в BOM залежить від конкретного формату й протоколу.