Unicode 編碼規則
輸入短文字,逐字元查看 Unicode 碼點、十進位值、所屬平面和 UTF-8 位元組,並保留碼點範圍速查。
瀏覽器本地處理
該頁面已通過公開目錄檢查;啟用JavaScript後可使用完整功能。
使用指南
如何使用Unicode 編碼規則
Unicode 與 UTF-8 結果只在目前瀏覽器中計算,不會上傳或儲存文字。
輸入短文字
輸入最多 64 個 Unicode 純量值;空白、重複字元和原始順序都會保留。
檢視碼點資訊
逐字元查看 U+ 記法、十進位碼點、Unicode 平面和大寫十六進位 UTF-8 位元組。
核對範圍
單字元查詢會連動對應碼點範圍;也可複製 TSV 或清除結果。
限制與注意事項
- 工具依 Unicode 標量值拆分,不進行 NFC、NFD 等正規化;組合序列會保留為多行。
- 代理項 U+D800–U+DFFF 不是 Unicode 純量值;孤立代理項不會被視為有效字元編碼。
- 碼點與 UTF-8 位元組無法說明字型一定包含字形,也不能取代 GBK、Big5 等舊式編碼查詢。
常見問題
為什麼一個 Emoji 只顯示一行,卻有四個 UTF-8 位元組?
該 Emoji 是補充平面的 Unicode 純量,UTF-8 會以四位元組序列表示它。
看起來相同的字元為什麼可能有不同結果?
預組字元與基本字元加上組合標記可能呈現相似字形,但由不同的 Unicode 純量序列組成;此工具不會自動正規化。
U+ 後面的數字是什麼進位制?
U+ 記法使用十六進位;頁面同時提供十進位碼點,便於交叉核對。