Unicode 转义

字符与 \u 转义序列互转,查看码位,处理表情与中文。

什么是Unicode 转义?

Unicode转义工具用于在普通字符(包括中文、日文、emoji等)和\u转义序列之间互相转换。每个字符在Unicode标准里都对应一个唯一的码位(code point),比如汉字"中"的码位是U+4E2D,转义写法就是\u4e2d;工具支持把一段文本批量转换成转义序列,也支持把包含\u转义的字符串还原成可读文字。 对于超出基本多语言平面(BMP,码位大于U+FFFF)的字符,比如很多emoji表情,JSON和JavaScript字符串里会用两个\u转义组成的"代理对"(surrogate pair)来表示一个字符,工具会正确处理这种情况,而不是简单地按字符逐个转义。

为什么使用Unicode 转义?

常见场景:调试接口返回的\u编码字符串,还原出实际的中文内容;处理国际化(i18n)语言包文件中的转义字符;检查某个特殊符号或emoji对应的具体Unicode码位,判断是否需要做兼容性处理;把包含中文的字符串转成纯ASCII的转义形式,兼容某些只支持ASCII的老旧系统或配置文件格式(如Java的.properties文件)。

使用示例

中文转Unicode转义

输入:你好 输出:\u4f60\u597d,两个汉字各对应一个\u转义序列。

还原JSON里的转义字符串

输入:\u676d\u5dde\u5e02 还原后:杭州市,常见于接口调试时后端返回了ASCII编码后的字符串。

emoji的代理对

输入emoji:😀 对应转义为\ud83d\ude00(两个\u组成一对代理项,因为该字符码位U+1F600超出了BMP范围)。

使用提示

如果还原后出现乱码,通常是原始转义序列被截断或代理对不完整(少了一半),需要检查原始字符串是否完整。

常见问题

为什么 emoji 会编码成两个 \u 转义?
emoji 等超出基本多文种平面(BMP)的字符在 UTF-16 中用「代理对」表示,需要两个 \uXXXX 才能还原成一个完整字符,本工具按码位(而非按 UTF-16 code unit)遍历,能正确处理这类字符。
支持 \u{XXXXX} 这种花括号写法吗?
支持,解码时同时识别 \uXXXX(固定 4 位)和 \u{XXXXX}(ES6 风格,位数不固定)两种转义写法。
数据会上传吗?
不会。字符与转义序列的互转全部在浏览器本地完成。
一个中文字符对应几个\u?
常见汉字都在基本多语言平面内,对应一个\u转义序列;但部分生僻字和大多数emoji表情码位超出BMP范围,需要用两个\u组成代理对表示。
转义后的字符串还是合法JSON吗?
是的,JSON标准允许字符串里用\uXXXX表示任意字符,转义后的内容可以直接作为合法JSON字符串使用。
能处理生僻字或特殊符号吗?
能,只要是Unicode标准收录的字符(包括生僻汉字、特殊符号、emoji)都能正确转义和还原。
转义和URL编码是一回事吗?
不是,\u转义是字符在Unicode码位层面的表示方式,主要用于字符串和JSON;URL编码(%XX形式)是对URL中特殊字符的百分号编码,两者用途和格式都不同,本工具只处理\u转义。

相关工具

相关教程

← 返回工具箱· 数据均在浏览器本地处理,不上传服务器。