HTML 字元解碼
在瀏覽器裡把 HTML 實體——名稱、十進位與十六進位——還原成純文字。
在你的瀏覽器中執行
第一個幾乎永遠是對的。最後一個會把中文內容膨脹好幾倍,只有舊系統才需要。
還沒有東西可以轉換。
同一個字元的三種寫法
、  和   都是不斷行空白,分別寫成名稱、十進位碼位與十六進位碼位。舊
標記裡還會出現大寫 X 的  ,同樣合法。
解碼器三種都接受,所以你不需要知道手上是哪一種。
被編碼兩次的文字
如果解出來的結果裡還有實體——最常見的是 &lt; 解成 <——那就是這段文字被編碼了兩次。
通常是某個環節在寫進資料庫時轉義了一次,讀出來時又轉了一次。
再解一次就能看到真正的內容。真正該修的地方在上游:只在輸出的那一刻轉義一次。
刻意不動的東西
單獨的 &。R&D 和 Tom & Jerry 都不會被更動,因為後面沒有接合法實體的 & 就只是一個
& 而已。在這裡自作聰明的解碼器會毀掉一般的文章。
不認得的名稱。&nosuchthing; 會原樣留著,而不是憑空消失。完整的 HTML5 名稱清單有兩千多
個;這裡收的是常用的那些,清單以外的東西仍然可以透過數值形式解碼。
單一代理碼位與超出範圍的碼位。� 是代理對的一半,本身不是字元;� 已經
超過 Unicode 的盡頭。兩者都會保留為文字而不是變成替代字元,因為把它們變成 “ 會讓原本
確實存在的資訊消失。
不斷行空白是看不見的
最常見的意外: 解出來的空白看起來和普通空白一模一樣,行為卻不同——它不會斷行,
也不會被「搜尋一個普通空白」比對到。
如果解碼後的文字在比對時表現得很奇怪,原因通常就是這個。
沒有任何上傳
在這個頁面裡解碼。