什么是HTML 实体编解码?
HTML 实体编解码用于查看或生成文本中的特殊字符表示。特殊字符模式只处理容易影响 HTML 语法的字符,完整模式则按 Unicode 码点输出数字实体。解码结果始终以纯文本呈现,因此可以检查标签内容,但不能把该工具误当成 HTML 净化器。常见使用场景包括:在文档或示例中安全展示尖括号和引号。;还原日志、富文本数据中的常见 HTML 实体。;检查 Emoji 和中文对应的数字实体。页面同时列出输入边界、输出规则和限制,便于在复制结果或投入实际流程前核对格式、语义与安全注意事项。
适用场景
- 在文档或示例中安全展示尖括号和引号。
- 还原日志、富文本数据中的常见 HTML 实体。
- 检查 Emoji 和中文对应的数字实体。
使用方法
- 选择仅特殊字符或完整编码模式。
- 输入普通文本或 HTML 实体。
- 执行编码或解码,再复制或交换结果。
- 先使用页面提供的复杂示例验证当前选项和运行方向,再替换为自己的数据。
- 检查输出区、状态提示和限制说明,确认结果符合预期后再复制、下载或继续处理。
可运行示例
工作区中的“示例 1”和“示例 2”按钮会载入对应内容。两个示例覆盖不同结构、方向或边界,可以直接运行并观察输出与状态提示。
示例 1
<article data-site="JSONLane">5 > 3 && "中文 🚀"</article>示例 2
<section class="notice">本地处理 & 默认保护输入 🔒</section>输入规则
- 编码输入作为普通文本处理。
- 数字实体必须以分号结束并指向有效 Unicode 标量。
- 未知命名实体会保留原样,不进行猜测。
- 文本输入在运行前按字符计数,当前页面上限为 1,000,000;文件类功能另按页面显示的文件上限执行。
- 命名实体仅明确支持 amp、apos、gt、lt、nbsp 和 quot;未知命名实体保持原样。
输出规则
- 特殊模式编码 &、<、>、单双引号。
- 完整模式按完整 Unicode 码点生成十六进制实体。
- 解码结果只显示为文本,不渲染标签和脚本。
- 输出只反映当前输入、方向和选项;切换模式或修改输入后应重新运行,不应把旧结果当成新结果。
- 数字实体必须以分号结束,并且表示有效 Unicode 标量值。
限制与注意事项
- 命名实体仅明确支持 amp、apos、gt、lt、nbsp 和 quot;未知命名实体保持原样。
- 数字实体必须以分号结束,并且表示有效 Unicode 标量值。
- HTML 实体解码不是 HTML 净化,不能当作安全过滤器。
数据处理说明
实体扫描和字符转换在本地完成,页面不会把解码结果插入为可执行 HTML。关闭或刷新页面后,本工具不会保留本次数据。