Unicode zasady kodowania
Wprowadź krótki tekst, aby dla każdego znaku wyświetlić Unicode punkt kodowy, wartość dziesiętną, należącą płaszczyznę i bajty UTF-8, zachowując także szybkie wyszukiwanie zakresów punktów kodowych.
Jak używać reguł kodowania Unicode
Wyniki Unicode i UTF-8 są obliczane wyłącznie w bieżącej przeglądarce; tekst nie jest przesyłany ani zapisywany.
Wprowadź krótki tekst
Wprowadź maksymalnie 64 wartości skalarnych Unicode; białe znaki, powtórzone znaki i pierwotna kolejność zostaną zachowane.
Wyświetl informacje o punkcie kodowym
Dla każdego znaku wyświetla notację U+, dziesiętny punkt kodowy, płaszczyznę Unicode oraz bajty UTF-8 w zapisie szesnastkowym wielkimi literami.
Sprawdź zakres
Wyszukiwanie pojedynczego znaku automatycznie powiąże odpowiedni zakres punktów kodowych; możesz też skopiować TSV lub wyczyścić wynik.
Ograniczenia i uwagi
- Narzędzie dzieli tekst według wartości skalarnych Unicode, bez wykonywania normalizacji NFC, NFD ani innych; sekwencje łączące są zachowywane w wielu wierszach.
- Jednostki zastępcze U+D800–U+DFFF nie są wartościami skalarnymi Unicode; izolowane jednostki zastępcze nie są traktowane jako prawidłowo kodowane znaki.
- Punkty kodowe i bajty UTF-8 nie świadczą o tym, że czcionka na pewno zawiera glif, ani nie zastępują zapytań dotyczących starszych kodowań, takich jak GBK i Big5.
Często zadawane pytania
Dlaczego Emoji zajmuje tylko jeden wiersz, ale ma cztery UTF-8 bajty?
Ten emoji jest skalarem Unicode z płaszczyzny uzupełniającej, a UTF-8 przedstawia go za pomocą sekwencji czterobajtowej.
Dlaczego znaki wyglądające tak samo mogą dawać różne wyniki?
Znaki złożone i znaki podstawowe z dołączonymi znakami łączącymi mogą mieć podobne glify, ale składają się z różnych sekwencji skalarów Unicode; to narzędzie nie normalizuje ich automatycznie.
W jakim systemie liczbowym zapisane są cyfry po U+?
Notacja U+ używa zapisu szesnastkowego; strona podaje również dziesiętny punkt kodowy, aby ułatwić weryfikację krzyżową.