文本转 Unicode 码点

💻 Text to Unicode Codepoint

Text to Unicode Codepoint - Show the U+ codepoint and UTF-16 escape for every character including CJK and emoji. Free, instant, browser-only.

📐 工作原理与说明
把文本转换为 Unicode 码点表示。
  • 输出格式:常见为 U+4E2D 或 \u4E2D 两种写法。
  • 辅助平面:emoji 等字符的码点大于 FFFF,需要 5–6 位十六进制表示。
  • 代理对:UTF-16 用两个码元表示辅助平面字符,这与码点是两个不同概念。
  • 用途:字体与编码调试、字符研究、生成转义序列。
⚠️ 使用说明与注意事项

🔣 常用 Unicode 符号

字符码点含义
—U+2014破折号 em dash
·U+00B7中间点
©U+00A9版权
®U+00AE注册商标
€U+20AC欧元
★U+2605实心星
✓U+2713对勾
🚀U+1F680火箭 emoji

中文常用汉字位于 U+4E00–U+9FFF(CJK 统一表意文字)区间。

📚 深度解析:Text to Unicode Codepoint

💡 常见使用场景

转换 "中"
输入 `中` → 输出 `U+4E2D`(十进制 20013);Emoji 😀 → `U+1F600`。

❓ 常见问题(FAQ)

代理对是什么?
超过 U+FFFF 的字符(如 Emoji)在 UTF-16 中用两个 16 位单元表示,即代理对。
为什么一个 emoji 有两个码点?
因为该字符位于辅助平面(码点 > U+FFFF),UTF-16 需用两个 16 位单元(代理对)表示;此外有些 emoji 由多个码点组合而成(带肤色修饰符、国旗由两个地区指示符组成、家庭 emoji 由多个人物加 ZWJ 连接)。因此「一个字符」不一定等于「一个码点」。