Unicode 编码规则
输入短文本,逐字符查看 Unicode 码点、十进制值、所属平面和 UTF-8 字节,并保留码点范围速查。
浏览器本地处理
该页面已通过公开目录检查;启用JavaScript后可使用完整功能。
使用指南
如何使用Unicode 编码规则
Unicode 与 UTF-8 结果只在当前浏览器中计算,不会上传或保存文本。
输入短文本
输入最多 64 个 Unicode 标量值;空白、重复字符和原始顺序都会保留。
查看码点信息
逐字符查看 U+ 记法、十进制码点、Unicode 平面和大写十六进制 UTF-8 字节。
核对范围
单字符查询会联动对应码点范围;也可复制 TSV 或清空结果。
限制与注意事项
- 工具按 Unicode 标量值拆分,不进行 NFC、NFD 等规范化;组合序列会保留为多行。
- 代理项 U+D800–U+DFFF 不是 Unicode 标量值;孤立代理项不会被当作有效字符编码。
- 码点与 UTF-8 字节不能说明字体一定有字形,也不能替代 GBK、Big5 等旧编码查询。
常见问题
为什么一个 Emoji 只显示一行却有四个 UTF-8 字节?
该 Emoji 是一个补充平面的 Unicode 标量,UTF-8 用四字节序列表示它。
看起来相同的字符为什么可能有不同结果?
预组字符与基础字符加组合标记可能呈现相似字形,但由不同的 Unicode 标量序列组成;本工具不会自动规范化。
U+ 后面的数字是什么进制?
U+ 记法使用十六进制;页面同时给出十进制码点便于交叉核对。