UTF-16 Tabel kode
Masukkan teks pendek untuk melihat unit kode UTF-16, byte BE/LE, serta jenis BMP atau pasangan surrogate per karakter, sekaligus mempertahankan referensi cepat rentang item surrogate.
Cara menggunakan tabel pengodean UTF-16
UTF-16 Unit kode dan hasil urutan byte hanya dihitung di browser saat ini dan teks tidak akan diunggah.
Masukkan teks singkat
Masukkan hingga 64 nilai skalar Unicode, lalu alat memproses setiap karakter sesuai urutan aslinya.
Lihat unit kode
Lihat setiap karakter sebagai satu unit kode BMP atau sepasang surrogate tinggi dan rendah, serta byte UTF-16BE dan UTF-16LE yang sesuai.
Periksa rentang item surrogate
Kueri satu karakter akan mengaitkan BMP atau aturan surrogate; Anda dapat menyalin TSV atau mengosongkan input.
Batasan dan catatan
- Kolom byte hanya menampilkan byte unit kode dalam urutan byte yang ditentukan, tidak otomatis menambahkan BOM, dan tidak menyimpulkan urutan byte file.
- Skalar bidang tambahan menggunakan dua unit kode 16; jumlah unit kode tidak dapat langsung dianggap sebagai jumlah karakter yang terlihat oleh pengguna.
- Pasangan pengganti tinggi atau rendah yang berdiri sendiri bukan nilai skalar Unicode yang valid; alat akan gagal dan berhenti, bukan menghasilkan byte pengganti.
Pertanyaan umum
Mengapa Emoji memiliki dua unit kode UTF-16?
Skalar bidang suplementer di atas U+10000 memerlukan satu surrogate tinggi dan satu surrogate rendah untuk direpresentasikan bersama.
Mengapa urutan byte UTF-16BE dan UTF-16LE berlawanan?
Keduanya merepresentasikan unit kode 16 bit yang sama, tetapi urutan penyimpanan byte tinggi dan byte rendah pada setiap unit kode berbeda.
Apakah keluaran halaman akan menyertakan BOM?
Tidak. Yang ditampilkan di sini adalah byte encoding satu skalar; apakah file memerlukan BOM bergantung pada format dan protokol tertentu.