Unicode кодова система
Введіть короткий текст, щоб переглянути для кожного символу кодову точку Unicode, десяткове значення, належність до площини та байти UTF-8, а також скористатися швидким довідником діапазонів кодових точок.
Як використовувати правило кодування Unicode
Результати Unicode і UTF-8 обчислюються лише в поточному браузері; текст не передається й не зберігається.
Введіть короткий текст
Введіть щонайбільше 64 скалярних значень Unicode; пробіли, повторювані символи та початковий порядок буде збережено.
Переглянути інформацію про кодову точку
Переглядайте для кожного символу запис U+, десяткову кодову точку, площину Unicode і байти у верхньому регістрі шістнадцяткового формату UTF-8.
Перевірити діапазон
Пошук одного символу пов’язаний із відповідним діапазоном кодових точок; також можна скопіювати TSV або очистити результати.
Обмеження та зауваження
- Інструмент розділяє дані за скалярними значеннями Unicode і не виконує нормалізацію, зокрема NFC та NFD; комбіновані послідовності зберігаються в кількох рядках.
- Сурогатні елементи U+D800–U+DFFF не є скалярними значеннями Unicode; ізольовані сурогатні елементи не вважаються кодуванням дійсних символів.
- Кодова точка та байти UTF-8 не свідчать про те, що шрифт обов’язково має гліф, і не замінюють запити старих кодувань, таких як GBK, Big5 та інші.
Поширені запитання
Чому один Emoji відображається в одному рядку, але має чотири UTF-8 байти?
Цей Emoji є скалярним значенням Unicode з додаткової площини, а UTF-8 представляє його послідовністю з чотирьох байтів.
Чому символи, які виглядають однаково, можуть давати різні результати?
Попередньо складений символ і базовий символ із комбінованою позначкою можуть мати схожі гліфи, але складаються з різних послідовностей скалярних значень Unicode; цей інструмент не виконує автоматичної нормалізації.
У якій системі числення записано числа після U+?
Позначення U+ використовує шістнадцяткову систему; на сторінці також наведено десяткову кодову точку для зручної перехресної перевірки.