关于Unicode 编码转换
Unicode 编码转换,用在文字变成一串编码的时候:接口返回的 JSON 里全是 \u4e2d\u6587,Java 的 properties 配置文件里的中文,网址和日志里的 %E4%B8%AD,或者要在代码里写一个表情符号。把编码粘贴进来,工具会自动判断它是 \u 转义、&# 编码、U+ 码点还是 UTF-8 字节,不用自己选。
反过来编码时,可以转成 \uXXXX 转义(表情这类超出 U+FFFF 的字符写成代理对,或者 \u{…})、十进制或十六进制的 HTML 编码、U+ 码点、UTF-8 字节(十六进制或 %XX 形式)以及 UTF-16。下方的表格列出每个字符的码点和 UTF-8 字节,文章里混进了零宽空格、长得很像的字母,一查就知道。全部在浏览器里完成,文字不上传。
Unicode 编码转换怎么用
- 1粘贴内容
要编码就贴文字,要解码就贴 \u 转义、&# 编码、码点或字节。
- 2选编码格式
编码时可选 \uXXXX、十进制或十六进制 HTML 编码、U+ 码点、UTF-8 字节或 UTF-16。
- 3看字符表
每个字符的码点和 UTF-8 字节逐行列出。
- 4复制结果
复制转换好的文字或编码。
为什么用熊仔工匠
- 自动识别格式
粘贴 \u 转义、&# 编码、U+ 码点或 UTF-8 字节,直接解码,不用选格式。
- 表情不出错
超出 U+FFFF 的字符转成代理对或 \u{…},来回转换不丢字。
- UTF-8 / UTF-16 字节
UTF-8 字节可以看十六进制,也可以看网址里的 %XX 写法。
- 逐字码点表
每个字符的码点和 UTF-8 字节一目了然。