Unicode 码点与字符查询

理解 U+ 码点、emoji 与特殊符号,如何用 ToolBox 查询字符的 Unicode 编码。

目录

什么是码点

Unicode 给每个字符分配一个编号,记作码点,如 U+0041 是字母 A。一个 emoji 可能由多个码点组成(如带肤色的表情)。

常见用途

排查「乱码/问号」时,查看字符的真实码点能定位是编码不一致还是字符本身不存在;特殊符号(如 © ✓ ❤)也靠码点引用。

在 ToolBox 中查询

输入字符或码点(如 U+1F600)即可双向查询,并显示 UTF-8/UTF-16 字节,便于调试传输与存储问题。

常见问题

一个 emoji 为什么显示成两个方框?
可能是系统字体缺该码点,或所用字体不含该 emoji 的字形;码点存在但无字形就会显示成豆腐块。
U+ 和 &#x 有什么区别?
U+1F600 是书写约定;😀 是 HTML 数字实体写法,二者指向同一码点。
中文也是 Unicode 吗?
是。中文常用码点位于 U+4E00 起的 CJK 统一表意文字区,同样适用码点查询。
← 返回「编码与加密」内容集群