免費註冊

Unicode 編碼轉換

中文轉成 \u 編碼、U+ 碼點或 UTF-8 位元組,也能把這些編碼還原成文字。

關於Unicode 編碼轉換

Unicode 編碼轉換,用在文字變成一串編碼的時候:介面返回的 JSON 裡全是 \u4e2d\u6587,Java 的 properties 配置檔案裡的中文,網址和日誌裡的 %E4%B8%AD,或者要在程式碼裡寫一個表情符號。把編碼貼上進來,工具會自動判斷它是 \u 轉義、&# 編碼、U+ 碼點還是 UTF-8 位元組,不用自己選。

反過來編碼時,可以轉成 \uXXXX 轉義(表情這類超出 U+FFFF 的字元寫成代理對,或者 \u{…})、十進位制或十六進位制的 HTML 編碼、U+ 碼點、UTF-8 位元組(十六進位制或 %XX 形式)以及 UTF-16。下方的表格列出每個字元的碼點和 UTF-8 位元組,文章裡混進了零寬空格、長得很像的字母,一查就知道。全部在瀏覽器裡完成,文字不上傳。

Unicode 編碼轉換怎麼用

  1. 1
    貼上內容

    要編碼就貼文字,要解碼就貼 \u 轉義、&# 編碼、碼點或位元組。

  2. 2
    選編碼格式

    編碼時可選 \uXXXX、十進位制或十六進位制 HTML 編碼、U+ 碼點、UTF-8 位元組或 UTF-16。

  3. 3
    看字元表

    每個字元的碼點和 UTF-8 位元組逐行列出。

  4. 4
    複製結果

    複製轉換好的文字或編碼。

為什麼用熊仔工匠

  • 自動識別格式

    貼上 \u 轉義、&# 編碼、U+ 碼點或 UTF-8 位元組,直接解碼,不用選格式。

  • 表情不出錯

    超出 U+FFFF 的字元轉成代理對或 \u{…},來回轉換不丟字。

  • UTF-8 / UTF-16 位元組

    UTF-8 位元組可以看十六進位制,也可以看網址裡的 %XX 寫法。

  • 逐字碼點表

    每個字元的碼點和 UTF-8 位元組一目瞭然。

常見問題

Unicode 編碼轉換常見問題

“\u”開頭的編碼怎麼轉成中文?
直接貼上,比如 \u4f60\u597d,解碼後就是“你好”。格式會自動識別,&#…; 編碼和 U+ 碼點也一樣。版權符號、不間斷空格這類命名實體,請用HTML 實體編碼轉換解碼。
為什麼一個表情是兩個 \u 編碼?
一個 \uXXXX 只有四位十六進位制,最多表示到 U+FFFF。表情在這個範圍之外,JSON 和 JavaScript 用兩個編碼組成的代理對來寫,比如 😀 是 \uD83D\uDE00;新版 JavaScript 也可以寫成 \u{1F600}。
碼點和 UTF-8 位元組有什麼區別?
碼點是字元在 Unicode 裡的編號,比如“中”是 U+4E2D;UTF-8 是儲存方式,“中”佔三個位元組 E4 B8 AD,網址裡的 %E4%B8%AD 就是這三個位元組。想看同一段文字的 GBK 或 UTF-16 位元組,可以用文字 Hex 編碼轉換。
中文轉 Unicode 有什麼用?
老式的 Java properties 檔案、一些只認 ASCII 的配置和指令碼,需要把中文寫成 \uXXXX;排查亂碼時,看碼點和位元組也能判斷是哪一步出了錯。
Unicode 編碼轉換時文字會上傳嗎?
不會。轉換在瀏覽器裡完成,頁面開啟後斷網也能用,不限次數。
把Unicode 編碼轉換分享給朋友開啟瀏覽器就能用,對方不註冊也能先試。

相關工具

HASH 雜湊加密 MD5 / SHA一次算出文字的 MD5、SHA-1、SHA-256、SHA-512 和 SM3。
TIME Unix 時間戳轉換Unix 時間戳與日期時間互轉,同時顯示本地時間和 UTC。
AES AES 加密解密用 AES(GCM、CBC、CTR 模式)加密或解密文字。
&;HTML HTML 實體編碼轉換把文字轉成 HTML 實體,或把實體還原成文字。
JWT JWT 解析解析 JWT 的頭部和載荷,檢查過期時間和簽名。
01BIN 進位制轉換數字在二進位制、八進位制、十進位制、十六進位制等進位制之間轉換。
BASE Base32 / Base58 編碼Base32、Base58、Base85、Base16 的編碼與解碼。
0xHEX 文字 Hex 編碼轉換把文字按 UTF-8、GBK 或 UTF-16 轉成十六進位制,或反過來。