免费注册

Unicode 编码转换

中文转成 \u 编码、U+ 码点或 UTF-8 字节,也能把这些编码还原成文字。

关于Unicode 编码转换

Unicode 编码转换,用在文字变成一串编码的时候:接口返回的 JSON 里全是 \u4e2d\u6587,Java 的 properties 配置文件里的中文,网址和日志里的 %E4%B8%AD,或者要在代码里写一个表情符号。把编码粘贴进来,工具会自动判断它是 \u 转义、&# 编码、U+ 码点还是 UTF-8 字节,不用自己选。

反过来编码时,可以转成 \uXXXX 转义(表情这类超出 U+FFFF 的字符写成代理对,或者 \u{…})、十进制或十六进制的 HTML 编码、U+ 码点、UTF-8 字节(十六进制或 %XX 形式)以及 UTF-16。下方的表格列出每个字符的码点和 UTF-8 字节,文章里混进了零宽空格、长得很像的字母,一查就知道。全部在浏览器里完成,文字不上传。

Unicode 编码转换怎么用

  1. 1
    粘贴内容

    要编码就贴文字,要解码就贴 \u 转义、&# 编码、码点或字节。

  2. 2
    选编码格式

    编码时可选 \uXXXX、十进制或十六进制 HTML 编码、U+ 码点、UTF-8 字节或 UTF-16。

  3. 3
    看字符表

    每个字符的码点和 UTF-8 字节逐行列出。

  4. 4
    复制结果

    复制转换好的文字或编码。

为什么用熊仔工匠

  • 自动识别格式

    粘贴 \u 转义、&# 编码、U+ 码点或 UTF-8 字节,直接解码,不用选格式。

  • 表情不出错

    超出 U+FFFF 的字符转成代理对或 \u{…},来回转换不丢字。

  • UTF-8 / UTF-16 字节

    UTF-8 字节可以看十六进制,也可以看网址里的 %XX 写法。

  • 逐字码点表

    每个字符的码点和 UTF-8 字节一目了然。

常见问题

Unicode 编码转换常见问题

“\u”开头的编码怎么转成中文?
直接粘贴,比如 \u4f60\u597d,解码后就是“你好”。格式会自动识别,&#…; 编码和 U+ 码点也一样。版权符号、不间断空格这类命名实体,请用HTML 实体编码转换解码。
为什么一个表情是两个 \u 编码?
一个 \uXXXX 只有四位十六进制,最多表示到 U+FFFF。表情在这个范围之外,JSON 和 JavaScript 用两个编码组成的代理对来写,比如 😀 是 \uD83D\uDE00;新版 JavaScript 也可以写成 \u{1F600}。
码点和 UTF-8 字节有什么区别?
码点是字符在 Unicode 里的编号,比如“中”是 U+4E2D;UTF-8 是存储方式,“中”占三个字节 E4 B8 AD,网址里的 %E4%B8%AD 就是这三个字节。想看同一段文字的 GBK 或 UTF-16 字节,可以用文本 Hex 编码转换。
中文转 Unicode 有什么用?
老式的 Java properties 文件、一些只认 ASCII 的配置和脚本,需要把中文写成 \uXXXX;排查乱码时,看码点和字节也能判断是哪一步出了错。
Unicode 编码转换时文字会上传吗?
不会。转换在浏览器里完成,页面打开后断网也能用,不限次数。
把Unicode 编码转换分享给朋友打开浏览器就能用,对方不注册也能先试。

相关工具

HASH 哈希加密 MD5 / SHA一次算出文字的 MD5、SHA-1、SHA-256、SHA-512 和 SM3。
TIME Unix 时间戳转换Unix 时间戳与日期时间互转,同时显示本地时间和 UTC。
AES AES 加密解密用 AES(GCM、CBC、CTR 模式)加密或解密文字。
&;HTML HTML 实体编码转换把文字转成 HTML 实体,或把实体还原成文字。
JWT JWT 解析解析 JWT 的头部和载荷,检查过期时间和签名。
01BIN 进制转换数字在二进制、八进制、十进制、十六进制等进制之间转换。
BASE Base32 / Base58 编码Base32、Base58、Base85、Base16 的编码与解码。
0xHEX 文本 Hex 编码转换把文字按 UTF-8、GBK 或 UTF-16 转成十六进制,或反过来。