HTML 字元解码
在浏览器里把 HTML 实体——名称、十进位与十六进位——还原成纯文字。
在你的浏览器中运行
第一个几乎永远是对的。最后一个会把中文内容膨胀好几倍,只有旧系统才需要。
还没有东西可以转换。
同一个字元的三种写法
、  和   都是不断行空白,分别写成名称、十进位码位与十六进位码位。旧
标记里还会出现大写 X 的  ,同样合法。
解码器三种都接受,所以你不需要知道手上是哪一种。
被编码两次的文字
如果解出来的结果里还有实体——最常见的是 &lt; 解成 <——那就是这段文字被编码了两次。
通常是某个环节在写进数据库时转义了一次,读出来时又转了一次。
再解一次就能看到真正的内容。真正该修的地方在上游:只在输出的那一刻转义一次。
刻意不动的东西
单独的 &。R&D 和 Tom & Jerry 都不会被更动,因为后面没有接合法实体的 & 就只是一个
& 而已。在这里自作聪明的解码器会毁掉一般的文章。
不认得的名称。&nosuchthing; 会原样留着,而不是凭空消失。完整的 HTML5 名称清单有两千多
个;这里收的是常用的那些,清单以外的东西仍然可以透过数值形式解码。
单一代理码位与超出范围的码位。� 是代理对的一半,本身不是字元;� 已经
超过 Unicode 的尽头。两者都会保留为文字而不是变成替代字元,因为把它们变成 “ 会让原本
确实存在的信息消失。
不断行空白是看不见的
最常见的意外: 解出来的空白看起来和普通空白一模一样,行为却不同——它不会断行,
也不会被「搜索一个普通空白」比对到。
如果解码后的文字在比对时表现得很奇怪,原因通常就是这个。
没有任何上传
在这个页面里解码。