Unicode 编码规则

输入短文本,逐字符查看 Unicode 码点、十进制值、所属平面和 UTF-8 字节,并保留码点范围速查。

浏览器本地处理
该页面已通过公开目录检查;启用JavaScript后可使用完整功能。
使用指南

如何使用Unicode 编码规则

Unicode 与 UTF-8 结果只在当前浏览器中计算,不会上传或保存文本。

  1. 输入短文本

    输入最多 64 个 Unicode 标量值;空白、重复字符和原始顺序都会保留。

  2. 查看码点信息

    逐字符查看 U+ 记法、十进制码点、Unicode 平面和大写十六进制 UTF-8 字节。

  3. 核对范围

    单字符查询会联动对应码点范围;也可复制 TSV 或清空结果。

限制与注意事项

  • 工具按 Unicode 标量值拆分,不进行 NFC、NFD 等规范化;组合序列会保留为多行。
  • 代理项 U+D800–U+DFFF 不是 Unicode 标量值;孤立代理项不会被当作有效字符编码。
  • 码点与 UTF-8 字节不能说明字体一定有字形,也不能替代 GBK、Big5 等旧编码查询。

常见问题

为什么一个 Emoji 只显示一行却有四个 UTF-8 字节?

该 Emoji 是一个补充平面的 Unicode 标量,UTF-8 用四字节序列表示它。

看起来相同的字符为什么可能有不同结果?

预组字符与基础字符加组合标记可能呈现相似字形,但由不同的 Unicode 标量序列组成;本工具不会自动规范化。

U+ 后面的数字是什么进制?

U+ 记法使用十六进制;页面同时给出十进制码点便于交叉核对。

页面反馈发现问题或有改进建议?
反馈功能需要在在线版使用

请在在线版启用 JavaScript 后提交;当前工具或案例的本地功能不受影响。

前往在线版反馈