Unicode 转义
字符与 \u 转义序列互转,查看码位,处理表情与中文。
什么是Unicode 转义?
Unicode转义工具用于在普通字符(包括中文、日文、emoji等)和\u转义序列之间互相转换。每个字符在Unicode标准里都对应一个唯一的码位(code point),比如汉字"中"的码位是U+4E2D,转义写法就是\u4e2d;工具支持把一段文本批量转换成转义序列,也支持把包含\u转义的字符串还原成可读文字。 对于超出基本多语言平面(BMP,码位大于U+FFFF)的字符,比如很多emoji表情,JSON和JavaScript字符串里会用两个\u转义组成的"代理对"(surrogate pair)来表示一个字符,工具会正确处理这种情况,而不是简单地按字符逐个转义。
为什么使用Unicode 转义?
常见场景:调试接口返回的\u编码字符串,还原出实际的中文内容;处理国际化(i18n)语言包文件中的转义字符;检查某个特殊符号或emoji对应的具体Unicode码位,判断是否需要做兼容性处理;把包含中文的字符串转成纯ASCII的转义形式,兼容某些只支持ASCII的老旧系统或配置文件格式(如Java的.properties文件)。
使用示例
中文转Unicode转义
输入:你好 输出:\u4f60\u597d,两个汉字各对应一个\u转义序列。
还原JSON里的转义字符串
输入:\u676d\u5dde\u5e02 还原后:杭州市,常见于接口调试时后端返回了ASCII编码后的字符串。
emoji的代理对
输入emoji:😀 对应转义为\ud83d\ude00(两个\u组成一对代理项,因为该字符码位U+1F600超出了BMP范围)。
使用提示
如果还原后出现乱码,通常是原始转义序列被截断或代理对不完整(少了一半),需要检查原始字符串是否完整。
常见问题
为什么 emoji 会编码成两个 \u 转义?
支持 \u{XXXXX} 这种花括号写法吗?
数据会上传吗?
一个中文字符对应几个\u?
转义后的字符串还是合法JSON吗?
能处理生僻字或特殊符号吗?
转义和URL编码是一回事吗?
相关工具
相关教程
← 返回工具箱· 数据均在浏览器本地处理,不上传服务器。