Unicode 转义

把字符转成 \uXXXX、\u{XXXXX}、U+XXXX 或 HTML 数字实体,也能把各种转义写法解回字符。

转义结果

编码时按码点处理,emoji 不会被拆坏;解码认得 JS、ES6、Unicode、HTML 四种写法。

本工具在你的浏览器内运行,输入的内容与文件不会上传到任何服务器。

常见问题

为什么 emoji 转出来是两个 4 位转义?
因为 JS、Java、CSS 通用的那种 4 位转义只能表示一个 UTF-16 码元,而 U+1F600 这类字符在 UTF-16 里要占两个码元,于是输出成一对「代理对」—— 两个连续的 4 位转义。这是正确写法,粘回代码里能正常运行。如果你想要一个整体,把「输出格式」改成 ES6 码点或 U+ 记法,它们直接写完整码点。
U+4F60 里的 4F60 是几位?
U+ 是 Unicode 官方记法,后面跟十六进制码点,最少 4 位,超过就按实际位数写 —— U+1F600 是 5 位。相对地,JS 那种 4 位转义固定 4 位,ES6 码点则用花括号把码点包起来。本工具按你选的格式输出,解码时这些写法都认。
下面那排「字符明细」有什么用?
它把你输入里出现过的非 ASCII 字符逐个列出来,标出 U+ 码点;鼠标悬停在标签上还能看到它在 UTF-8 里占几个字节 —— 中文通常 3 字节、emoji 通常 4 字节。排查「为什么这段文字的长度和预期不一样」时很好用。

相关工具