跳到主要内容

将文本编码为 Unicode 码点,或把 U+、\u 转义和 HTML 数字实体解码回文本。支持中文和 emoji,并展示 UTF-8 字节;不将原始 UTF-8 字节当作解码输入。

Unicode 文本转换

查看字符背后的码点与转义表示。

支持中文、emoji 与补充平面字符,最多 4,000 个码点。

示例4 个码点

转换结果

原始文本
你好 👋
Unicode 码点
U+4F60 U+597D U+0020 U+1F44B
UTF-16 转义
\u4F60\u597D\u0020\uD83D\uDC4B
HTML 十进制实体
你好 👋
UTF-8 字节(十六进制)
E4 BD A0 E5 A5 BD 20 F0 9F 91 8B
逐字符查看 码点数量不等于视觉字符数量。
字符码点UTF-16HTML 实体
U+4F60\u4F60你
U+597D\u597D好
U+0020\u0020 
👋U+1F44B\uD83D\uDC4B👋

使用说明

  1. 选择“文本 → Unicode”或“Unicode → 文本”。
  2. 输入原文、U+ 码点、\u 转义或 HTML 数字实体。
  3. 按用途复制某种表示,或一次复制全部对照结果。

输入与输出示例

示例输入
😀
示例输出
码点:U+1F600 UTF-16:\uD83D\uDE00 HTML:😀

一个码点可以使用两个 UTF-16 代码单元。视觉上的一个 emoji 也可能由多个码点组合。

常见问题

不能。解码只还原原来的字符,不翻译语言。例如 U+4F60 解码后仍是“你”。

Unicode 给字符分配码点;UTF-8 和 UTF-16 是编码这些码点的方式。这里分别展示码点、UTF-16 转义和 UTF-8 字节,避免混淆。

组合音标、肤色修饰符和家庭 emoji 等可能由多个码点组成。本工具统计码点,不把它当作视觉字符数。

当前 UTF-8 一栏只做字节展示。解码输入支持码点、UTF-16 转义和 HTML 数字实体;不自动猜测原始字节编码。最多转换 4,000 个码点。

计算依据与参考资料

区分 Unicode 码点、UTF-16 代码单元与 UTF-8 字节,按所选表示转换;有效代理对会组成一个码点。逐码点结果不等同于人眼看到的字形数量。

内容核对: · 关于本站与内容说明

相关工具