toolfree

HTML 字元解碼

在瀏覽器裡把 HTML 實體——名稱、十進位與十六進位——還原成純文字。

在你的瀏覽器中執行

結果

還沒有東西可以轉換。

同一個字元的三種寫法

    都是不斷行空白,分別寫成名稱、十進位碼位與十六進位碼位。舊 標記裡還會出現大寫 X 的  ,同樣合法。

解碼器三種都接受,所以你不需要知道手上是哪一種。

被編碼兩次的文字

如果解出來的結果裡還有實體——最常見的是 < 解成 <——那就是這段文字被編碼了兩次。 通常是某個環節在寫進資料庫時轉義了一次,讀出來時又轉了一次。

再解一次就能看到真正的內容。真正該修的地方在上游:只在輸出的那一刻轉義一次。

刻意不動的東西

單獨的 &。R&DTom & Jerry 都不會被更動,因為後面沒有接合法實體的 & 就只是一個 & 而已。在這裡自作聰明的解碼器會毀掉一般的文章。

不認得的名稱。&nosuchthing; 會原樣留著,而不是憑空消失。完整的 HTML5 名稱清單有兩千多 個;這裡收的是常用的那些,清單以外的東西仍然可以透過數值形式解碼。

單一代理碼位與超出範圍的碼位。� 是代理對的一半,本身不是字元;� 已經 超過 Unicode 的盡頭。兩者都會保留為文字而不是變成替代字元,因為把它們變成 “ 會讓原本 確實存在的資訊消失。

不斷行空白是看不見的

最常見的意外:  解出來的空白看起來和普通空白一模一樣,行為卻不同——它不會斷行, 也不會被「搜尋一個普通空白」比對到。

如果解碼後的文字在比對時表現得很奇怪,原因通常就是這個。

沒有任何上傳

在這個頁面裡解碼。