Unicode kodlama kuralı
Kısa bir metin girin; her karakter için Unicode kod noktasını, ondalık değerini, ait olduğu düzlemi ve UTF-8 baytını görüntüleyin ve kod noktası aralığı hızlı başvurusunu koruyun.
Unicode kodlama standardı nasıl kullanılır
Unicode ve UTF-8 sonuçları yalnızca mevcut tarayıcıda hesaplanır; metin yüklenmez veya kaydedilmez.
Kısa metin girin
En fazla 64 adet Unicode skaler değer girin; boşluklar, yinelenen karakterler ve özgün sıra korunur.
Kod noktası bilgilerini görüntüle
Her karakter için U+ gösterimini, ondalık kod noktasını, Unicode düzlemini ve büyük harfli onaltılık UTF-8 baytını görüntüleyin.
Aralığı doğrula
Tek karakter sorgusu ilgili kod noktası aralığını da günceller; ayrıca TSV kopyalayabilir veya sonuçları temizleyebilirsiniz.
Sınırlamalar ve dikkat edilmesi gerekenler
- Araç, Unicode skaler değerlerine göre ayırır; NFC, NFD gibi normalleştirmeler yapmaz; birleştirme dizileri birden çok satır olarak korunur.
- Vekil öğeler U+D800–U+DFFF bir Unicode skaler değeri değildir; tek başına kalan vekil öğeler geçerli karakter kodlaması olarak kabul edilmez.
- Kod noktası ile UTF-8 baytlar, yazı tipinde mutlaka bir glif bulunduğunu göstermez ve GBK, Big5 gibi eski kodlama sorgularının yerini tutmaz.
Sık sorulan sorular
Bir Emoji neden tek satırda görüntülenmesine rağmen dört UTF-8 bayta sahiptir?
Bu Emoji, tamamlayıcı düzlemde bir Unicode skaleridir; UTF-8 onu dört baytlık bir diziyle gösterir.
Aynı görünen karakterlerin sonuçları neden farklı olabilir?
Önceden oluşturulmuş karakterler ile temel karakterlerin birleştirici işaretlerle birlikte kullanılması benzer glifler gösterebilir, ancak farklı Unicode skaler dizilerinden oluşurlar; bu araç otomatik normalleştirme yapmaz.
U+ sonrasındaki sayı hangi sayı sistemindedir?
U+ gösterimi onaltılık sistemi kullanır; sayfa, çapraz doğrulamayı kolaylaştırmak için ondalık kod noktalarını da verir.