Skip to main content
UFOZoo

Unicode转换 在线编码解码与字符查询

支持UTF-8、UTF-16、HTML、CSS、URL等编码,文本与Unicode码点互转,可查询字符信息、分类和区块,适合编码学习和调试等场景。

更新于 2026-08-26

相关工具

功能特性

  • 编码文本为 Unicode(UTF-8、UTF-16、HTML、CSS、URL)
  • 解码 Unicode 为文本
  • 自动检测输入格式
  • 查看字符详细信息
  • 显示每个字符的 11 种编码格式
  • 支持双向转换
  • 完整 Unicode 覆盖:U+0000 到 U+10FFFF 全部码点可用,包括 emoji、CJK 和非拉丁文字
  • Emoji 与特殊符号查询:查任意 emoji、箭头、货币或数学符号的精确码点和 UTF-8 字节
  • 一键复制:码点、UTF-8 字节序列或 HTML 实体,无需手动框选
  • 首次加载后支持离线使用

使用方法

  1. 1编码模式:输入文本转换为 Unicode 格式。
  2. 2解码模式:粘贴 Unicode 转换回文本。
  3. 3查询模式:输入字符查看所有编码。
  4. 4选择输出格式(U+XXXX、JS 转义、HTML 实体等)。
  5. 5点击任意值复制到剪贴板。
  6. 6输入 ©、™、→ 等符号查看其精确的 Unicode 代码点、UTF-8 字节和 HTML 实体,方便向网站添加特殊字符。
  7. 7使用查询模式检查 emoji 的 Unicode 属性:输入 😀 查看 U+1F600、其 UTF-8 编码(F0 9F 98 80)及所有相关编码格式。
  8. 8解码来自 Node.js 控制台输出的 \uXXXX JavaScript 转义序列:粘贴 \u4F60\u597D 到解码模式得到中文文本。
  9. 9将特殊字符编码为 HTML 实体来准备邮件简报的 HTML 内容:输入 ➡ 得到 ➡ 或 ➝,确保最大兼容性。
  10. 10将 Unicode 字符转换为其 CSS 转义格式来编写 CSS :before 伪元素内容:输入 ★ 得到 \2605(星号符号)。

常见问题

什么是 Unicode?

Unicode 是通用字符编码标准,为所有语言的每个字符分配唯一数字(代码点)。它包含 143,000+ 字符,覆盖 154 种文字、符号和 Emoji。与 ASCII(128 个字符)不同,Unicode 可以表示任何语言的文本,是现代文本处理的基础。

UTF-8 和 UTF-16 有什么区别?

UTF-8 和 UTF-16 是 Unicode 的编码方案。UTF-8 每个字符使用 1-4 字节(ASCII 使用 1 字节,大多数语言使用 2-3,Emoji 使用 4)。UTF-16 使用 2 或 4 字节。UTF-8 是 Web 和 API 最常用的编码,因为它与 ASCII 兼容且对拉丁文本节省空间。UTF-16 被 JavaScript 和 Windows 内部使用。

如何查看字符的完整信息?

选择'查询'模式,输入任意字符(如'中'、'→'、'😀'),即可查看其 11 种编码格式:代码点、十进制、UTF-8/UTF-16/UTF-32 字节、HTML 实体、CSS 转义、JS/Python 转义、URL 编码等。

什么是 Unicode 代理对?

代理对是 UTF-16 中用来表示基本多文种平面(BMP)之外字符(如 emoji)的两个 16 位代码单元(U+D800–U+DFFF)。例如 😀(U+1F600)在 JavaScript UTF-16 字符串中编码为代理对 \uD83D\uDE00。

为什么同一个 emoji 在不同设备上看起来不一样?

Emoji 的外观取决于平台的字体和设计。虽然 Unicode 代码点相同(例如 U+1F600 表示 😀),但 Apple、Google、Microsoft 和 Samsung 各自设计自己的 emoji 图案。工具显示标准代码点和编码,不受渲染差异影响。

Unicode 规范化形式(NFC、NFD、NFKC、NFKD)有什么区别?

NFC 组合字符(ü 作为一个代码点),NFD 分解字符(ü 分解为 u + 组合分音符)。NFKC/NFKD 是兼容形式,还会替换印刷变体(fi → fi)。'Café' 根据规范化形式可能是 4 或 5 个代码点,工具显示实际的编码形式。

键盘上没有的 Unicode 字符如何输入?

Windows 使用 Alt + 十进制代码点(如 Alt+0169 输入 ©)。Mac 使用 Ctrl+Cmd+Space 打开 emoji 选择器。代码中,JavaScript 字符串使用 \uXXXX 转义,HTML 使用 &#XXXX; 实体。使用本工具的编码模式查找任意字符的正确代码。

为什么某些字符显示为方框或问号?

这说明系统缺少包含该字符的字体。Unicode 是标准,但渲染取决于已安装的字体。无论浏览器能否显示,工具都显示字符信息。复制代码点用于网页字体或自定义图标中。

为什么我的文本显示乱码?

乱码通常是文件用一种编码保存、用另一种编码读取造成的(mojibake)。本转换器显示文本的Unicode码点,可以验证实际字符。如果从文件粘贴,先尝试用UTF-8重新保存。

怎么查一个字符的Unicode码点?

把字符粘贴进转换器,会显示十六进制和十进制码点、UTF-8字节和字符分类。Emoji还会显示码点序列,因为emoji通常由多个码点组成。

如何使用 HTML 实体?

HTML 实体用 &#十进制; 或 &#x十六进制; 表示字符,例如 &#169; 或 &#xA9; 都是 ©。在 HTML 中书写保留字符(<、>、&)时也必须转义。选择工具的编码模式并选择 HTML 实体格式,即可得到任意字符的实体写法。

为什么要了解 Unicode 区块?

Unicode 把字符按区块分组,例如 CJK 统一表意文字、箭头、表情符号。知道区块有助于:判断字符属于哪类文字、为自定义字体规划字形范围、排查乱码(字符来自意外区块)、以及在文档规范中限定可接受的字符范围。工具会显示任意字符所属的区块。

如何查找特定字符?

在查询模式中粘贴一个字符即可看到它的全部编码信息,这是按字符查。如果你记得字符形状但不认识它,可以用浏览器的系统字符映射表(Windows 的 charmap、macOS 的字符查看器)按类别浏览后复制进来查询。

为什么同一个字符在不同的 Unicode 转换器里显示的码点不一样?

通常因为一边是预组合形式、另一边是分解形式:é 可以是一个码点(U+00E9),也可以是 e 加组合重音符(U+0065 U+0301),两者视觉相同但数值不同。文字处理器和 OCR 有时会悄悄切换形式。比较前先把两边规范化到同一形式(通常用 NFC),并小心 emoji 序列里的零宽连接符。

为什么从 Word 复制粘贴后,在线 Unicode 转换器的结果变了?

Word 会自动把直引号改成弯引号、把三个点改成…、把连字符改成长破折号,并应用 NFC 规范化,所以你粘贴的文本和输入时并不逐字节相同。Unicode 转换器在线使用时显示的是真实码点;需要精确字符时,关闭 Word 的自动套用格式(文件 > 选项 > 校对 > 自动更正),或重新输入受影响的符号。Word 插入的不间断空格(U+00A0)是常见的隐藏差异。