← 返回工具箱

开发 / 文本编码

HTML 实体编码解码

正确处理 HTML5 命名实体、数字实体和 XML 实体,不再只替换五个符号。转换全部在当前浏览器完成,可复制、反向检查或下载文本。

UTF-8 网页通常只需要转义 &、<、>、"、' 等会影响标记结构的字符, 不必把所有中文都改成实体。完整 HTML5 或数字实体更适合旧系统、源码传输和明确要求只使用 ASCII 的场景。

常见写法对照

字符命名实体十进制十六进制用途
&&amp;&#38;&#x26;实体起始符
<&lt;&#60;&#x3C;标签起始符
>&gt;&#62;&#x3E;标签结束符
"&quot;&#34;&#x22;双引号属性
©&copy;&#169;&#xA9;版权符号

RELATED TOOLS

查看全部工具 →

USE & REVIEW

HTML 实体编码解码 / HTML5 与 XML常见问题

查看全部工具指南 →

普通 UTF-8 网页需要把所有中文都转成 HTML 实体吗?

不需要。页面和响应正确使用 UTF-8 时,中文可以直接保留,源码也更容易阅读。通常只需转义会改变 HTML 结构的 &、<、> 和属性引号。完整 HTML5、十进制或十六进制实体更适合旧系统、纯 ASCII 传输或明确要求数字码点的场景。

HTML 实体和 URL 百分号编码有什么区别?

HTML 实体用于 HTML 文本和属性语法,例如 &amp;lt; 表示小于号;URL 编码用于链接组成部分,例如空格常写成 %20,中文会按 UTF-8 字节转成百分号序列。两者不能互换。处理查询参数和路径时应使用 URL 编码工具,不要先套一层 HTML 实体规则。

宽松 HTML 解码和严格解码有什么区别?

浏览器为了兼容旧网页,会在部分上下文识别没有分号的历史命名实体,因此宽松模式可能解码 &amp;copy 之类写法。严格 HTML 模式只处理完整实体,XML 严格模式的命名集合更小。检查规范数据或模板输入时优先严格模式,恢复旧网页文本时可以尝试宽松模式并人工复核。

为什么连续编码会出现 &amp;amp;amp;?

第一次编码把 & 变成 &amp;amp;,第二次又把这个实体开头的 & 编码,于是得到 &amp;amp;amp;。这叫二次编码。工具会在输入中发现完整实体时提醒;确定这些实体原本代表字符后,可以开启“先解码已有实体”,但混合了真实字面实体和待编码文本时仍应先拆分处理。

十进制实体和十六进制实体显示效果不同吗?

只要码点有效,它们表示同一个 Unicode 字符,浏览器显示结果没有本质区别。例如 © 可以写成 &amp;#169; 或 &amp;#xA9;。十进制常见于数据导出,十六进制更容易和 Unicode 码点对照;两种写法都应带分号,并避免无效码点和孤立代理值。

解码 HTML 实体会执行脚本吗?

这个工具使用字符实体解析库把引用还原成普通文本,并把结果放在只读 textarea 中,不会把输出作为 HTML 插入页面或执行脚本。但如果你随后把解码结果不经清理地写入 innerHTML、CMS 模板或邮件正文,仍可能产生 XSS 风险;实体解码不等于内容消毒。