toolfree

HTML 字元解码

在浏览器里把 HTML 实体——名称、十进位与十六进位——还原成纯文字。

在你的浏览器中运行

结果

还没有东西可以转换。

同一个字元的三种写法

    都是不断行空白,分别写成名称、十进位码位与十六进位码位。旧 标记里还会出现大写 X 的  ,同样合法。

解码器三种都接受,所以你不需要知道手上是哪一种。

被编码两次的文字

如果解出来的结果里还有实体——最常见的是 < 解成 <——那就是这段文字被编码了两次。 通常是某个环节在写进数据库时转义了一次,读出来时又转了一次。

再解一次就能看到真正的内容。真正该修的地方在上游:只在输出的那一刻转义一次。

刻意不动的东西

单独的 &。R&DTom & Jerry 都不会被更动,因为后面没有接合法实体的 & 就只是一个 & 而已。在这里自作聪明的解码器会毁掉一般的文章。

不认得的名称。&nosuchthing; 会原样留着,而不是凭空消失。完整的 HTML5 名称清单有两千多 个;这里收的是常用的那些,清单以外的东西仍然可以透过数值形式解码。

单一代理码位与超出范围的码位。� 是代理对的一半,本身不是字元;� 已经 超过 Unicode 的尽头。两者都会保留为文字而不是变成替代字元,因为把它们变成 “ 会让原本 确实存在的信息消失。

不断行空白是看不见的

最常见的意外:  解出来的空白看起来和普通空白一模一样,行为却不同——它不会断行, 也不会被「搜索一个普通空白」比对到。

如果解码后的文字在比对时表现得很奇怪,原因通常就是这个。

没有任何上传

在这个页面里解码。