什么是Unicode 转义转换器?

Unicode 转义转换工具可将转义序列(如 \u0041)转换为可读字符,也可反向操作。支持 JavaScript \uXXXX、HTML 实体、Python 和 URL 百分号编码,方便调试国际化字符串、解码 API 响应或为代码准备文本。

工具支持六种转义格式。JavaScript 风格的 \uXXXX 覆盖基本多语言平面,表情符号和较少见的汉字会用代理对表示。JavaScript ES6 的 \u{X} 用一段就能写出任意码位,现代代码因此无需再用代理对。HTML 数字实体 &#xHHHH; 可直接写在 HTML 或邮件里。CSS 风格 \HHHH 写在样式表的 content 属性里。Python 对基本平面用 \uXXXX,超出部分用 \UXXXXXXXX,结果可直接粘进 Python 字符串。URL 百分号编码 %XX 会逐个转义 UTF-8 字节,适合查询字符串和路径片段。开关可切换十六进制大小写,仅转义非 ASCII 的模式让可打印字符保持原样,JSON 和 i18n 文件依旧易读。映射面板会列出每个字符的码位、官方 Unicode 名称、原始 UTF-8 字节、区块和类别,点击任一卡片即可只复制该字符的转义。

使用方法

  1. 第一步 — 将 Unicode 转义序列(例如 \u0048\u0065\u006C\u006C\u006F)粘贴到输入框中,将其解码为可读字符。
  2. 第二步 — 或输入纯文本(例如 Hello)将其编码为指定格式的 Unicode 转义序列。
  3. 第三步 — 选择转义格式(JavaScript \uXXXX、HTML &#xHHHH;、CSS \HHHH、Python \U 或 URL %XX)并复制结果。映射面板会给出每个字符的名称,并拆解其 UTF-8 字节、区块和类别;点击卡片即可复制单个转义。

何时使用

  • 解码接口返回的 \u00E9 之类内容,核对真实字符是否正确。
  • 把中文等非 ASCII 文本编码成 JSON 或 JavaScript 源码,避免被仅支持 ASCII 的中间系统破坏。
  • 排查复制来的字符串里藏着的零宽空格、BOM 等不可见 Unicode 字符。

结果

API 返回了 \u0041\u006E\u0064\u0072\u00E9,您需要获取实际姓名。粘贴后即可看到“André”,然后将回复文本转换回转义序列用于 API 请求体。

常见问题

为什么某些字符在 JavaScript 里要用两个 \uXXXX 表示?
码位超过 U+FFFF 的字符(表情、古文字、罕见汉字)在基本多语言平面之外。JavaScript 用 UTF-16 代理对来表示,例如火箭表情就写成 \uD83D\uDE80。支持 ES2015 的现代代码可改写为 \u{1F680}。
我的代码里应该用哪种转义格式?
JavaScript 或 JSON 字符串里用 \uXXXX;裸 HTML 里用 &#xHHHH;;CSS content 属性里用 \HHHH;查询字符串和路径片段则用 URL %XX 百分号编码。JSON 不支持 \u{...} 写法,所以 JSON 里要继续使用 \uXXXX 配合代理对。
转义和 HTML 实体到底有什么不同?
两者指向同一个 Unicode 码位。转义(\u00E9)由语言运行时处理,如 JavaScript、CSS、Python;HTML 实体(é 或 é)则由浏览器在解析 HTML 时处理。它们不能跨场景互换。
怎么找出字符串里看不见的 Unicode 字符?
粘贴文本后切到编码模式,字符映射表会按顺序列出每个码位。零宽空格(U+200B)、字节序标记(U+FEFF)、非断开空格(U+00A0)这些不可见字符会和它们的转义一并显示出来。
工具能解码 Python 源码里的 \u 转义吗?
可以。Python 的 \u0041、\U0001F680 与 JavaScript 的 \uXXXX、\u{1F680} 用法一致。把字符串内容(去掉外层引号和 r 前缀)粘进来,解码后就能得到可读文本。

相关工具