UTF-16 tabela kodowania
Wpisz krótki tekst, aby wyświetlić znak po znaku jednostki kodowe UTF-16, bajty BE/LE oraz typy BMP lub par surogatów, zachowując skrócone zestawienie zakresów surogatów.
Jak korzystać z tabeli kodowania UTF-16
UTF-16 Jednostki kodu i wyniki kolejności bajtów są obliczane wyłącznie w bieżącej przeglądarce; tekst nie jest przesyłany.
Wprowadź krótki tekst
Wprowadź maksymalnie 64 wartości skalarnych Unicode; narzędzie przetwarza znaki w ich pierwotnej kolejności.
Wyświetl jednostki kodu
Przeglądaj znak po znaku pojedynczą jednostkę kodu BMP lub parę surogatów wysokiego i niskiego oraz odpowiadające im bajty UTF-16BE i UTF-16LE.
Sprawdź zakres jednostek zastępczych
Wyszukiwanie pojedynczego znaku jest powiązane z BMP lub regułami surogatów; można skopiować TSV lub wyczyścić dane wejściowe.
Ograniczenia i uwagi
- Kolumna bajtów pokazuje tylko bajty jednostek kodowych w określonym porządku bajtów; nie dodaje automatycznie BOM ani nie wnioskuje o porządku bajtów pliku.
- Skalary z płaszczyzn dodatkowych używają dwóch 16 jednostek kodu; liczby jednostek kodu nie można bezpośrednio utożsamiać z liczbą znaków widocznych dla użytkownika.
- Samotny starszy lub młodszy element zastępczy nie jest prawidłową wartością skalarną Unicode; narzędzie zakończy działanie z błędem, zamiast wygenerować bajty zastępcze.
Często zadawane pytania
Dlaczego emoji mają dwie jednostki kodu UTF-16?
Skalary z dodatkowych płaszczyzn powyżej U+10000 wymagają wspólnej reprezentacji za pomocą surogatu wysokiego i niskiego.
Dlaczego UTF-16BE i UTF-16LE mają odwrotną kolejność bajtów?
Oba reprezentują te same jednostki kodowe o 16 bitach; różni je tylko kolejność zapisu starszego i młodszego bajtu każdej jednostki kodowej.
Czy dane wyjściowe strony będą zawierać BOM?
Nie. Są tu wyświetlane bajty kodowania pojedynczego skalara; to, czy plik wymaga BOM, zależy od konkretnego formatu i protokołu.