HTML 实体编解码 — 转义、反转义、本地处理
在浏览器内对文本做 HTML 实体编码或解码。步骤:选择编码/解码,粘贴内容,设置范围(最小 / 仅非 ASCII / 全部)与输出形式(命名 / 十进制 / 十六进制),然后复制。示例:Tom & Jerry → Tom & Jerry;支持 ©、©、emoji 😀,粘贴不上传。
怎么用
选「编码」把字符转成 HTML 字符引用,选「解码」做反向还原。编码按字符逐位处理,可选范围与输出形式(如 ©、©、©)。解码用安全的 textarea 解析;预览区只显示纯文本,不会渲染 HTML。
规则说明
编码/解码时各选项的含义,以及命名实体与数字实体的对应关系。
- 最小范围只转义 & < > " ',适合一般 HTML 文本。仅非 ASCII 保留英文与符号,把中文、emoji 等转成实体。全部 = 最小 + 非 ASCII。
- 命名(©)、十进制(©)、十六进制(©)解码结果相同。编码选「命名」时常见符号用名称,其余用数字形式。
- 对已转义文本再编码会产生双重编码(& → &amp;)。怀疑双重编码时可用「直到稳定」解码。真实 HTML 属性值有时还需额外转义引号。
- 隐私:粘贴不上传;本工具零外部库,转换全在浏览器完成。
示例
编码(最小+命名):Tom & Jerry <3 → Tom & Jerry <3。编码(非 ASCII+十六进制):© 😀 → © 😀。解码:<p>Tom & Jerry © 😀</p> → 预览为纯文本 `<p>Tom & Jerry © 😀</p>`。
适用场景
- 开发者:把 API/日志里的 <div>… 解码后再 diff 或编辑。
- 内容/CMS:标题或摘要含 &、< 时先编码再写入 HTML 模板。
- 邮件/多语言:把 emoji 或特殊符号转成数字实体以兼容旧客户端。
常见问题
三种编码范围有什么区别?
最小只转义 & < > " ' 五个字符;仅非 ASCII 保留 ASCII 原样;全部同时做最小转义与非 ASCII 转义。按你是防 HTML 破坏还是保 Unicode 可读来选。
©、©、© 一样吗?
解码时一样,都会变成 ©。编码时选命名更易读,选十进制/十六进制便于模板或邮件指定格式。
文本被编码了两次怎么办?
可能看到 &amp;。正常解码一次,或选「直到稳定」自动重复解码(最多八遍)。避免对已转义结果再点编码。
这能消毒 HTML、防 XSS 吗?
不能。实体编码只是表示字符,不是 sanitizer。解码预览只用纯文本展示,不会在页面上渲染你的 HTML。
内容会上传吗?
不会。转换在本地完成,不加载外部库,也不上传粘贴内容。
咨询与反馈
页面不清、功能异常或想提建议?在下方起草邮件,我们会阅读每一封关于工具的来信。