關於Unicode 編碼轉換
Unicode 編碼轉換,用在文字變成一串編碼的時候:介面返回的 JSON 裡全是 \u4e2d\u6587,Java 的 properties 配置檔案裡的中文,網址和日誌裡的 %E4%B8%AD,或者要在程式碼裡寫一個表情符號。把編碼貼上進來,工具會自動判斷它是 \u 轉義、&# 編碼、U+ 碼點還是 UTF-8 位元組,不用自己選。
反過來編碼時,可以轉成 \uXXXX 轉義(表情這類超出 U+FFFF 的字元寫成代理對,或者 \u{…})、十進位制或十六進位制的 HTML 編碼、U+ 碼點、UTF-8 位元組(十六進位制或 %XX 形式)以及 UTF-16。下方的表格列出每個字元的碼點和 UTF-8 位元組,文章裡混進了零寬空格、長得很像的字母,一查就知道。全部在瀏覽器裡完成,文字不上傳。
Unicode 編碼轉換怎麼用
- 1貼上內容
要編碼就貼文字,要解碼就貼 \u 轉義、&# 編碼、碼點或位元組。
- 2選編碼格式
編碼時可選 \uXXXX、十進位制或十六進位制 HTML 編碼、U+ 碼點、UTF-8 位元組或 UTF-16。
- 3看字元表
每個字元的碼點和 UTF-8 位元組逐行列出。
- 4複製結果
複製轉換好的文字或編碼。
為什麼用熊仔工匠
- 自動識別格式
貼上 \u 轉義、&# 編碼、U+ 碼點或 UTF-8 位元組,直接解碼,不用選格式。
- 表情不出錯
超出 U+FFFF 的字元轉成代理對或 \u{…},來回轉換不丟字。
- UTF-8 / UTF-16 位元組
UTF-8 位元組可以看十六進位制,也可以看網址裡的 %XX 寫法。
- 逐字碼點表
每個字元的碼點和 UTF-8 位元組一目瞭然。