跳到主内容
UniKit

HTML 实体转义 / 反转义

HTML 实体在线转义与反转义:内置 250+ 条命名实体,支持十进制/十六进制数字实体、最小转义与全部非 ASCII 转义,并可保留已有实体。

浏览器本地运行所有计算都在你的浏览器里完成,数据不会离开本机。

结果

命名实体速查

ÆÆU+00C6
ÁÁU+00C1
ÂÂU+00C2
ÀÀU+00C0
ΑΑU+0391
ÅÅU+00C5
ÃÃU+00C3
ÄÄU+00C4
ΒΒU+0392
ÇÇU+00C7
ΧΧU+03A7
‡‡U+2021
ΔΔU+0394
ÐÐU+00D0
ÉÉU+00C9
ÊÊU+00CA
ÈÈU+00C8
ΕΕU+0395
ΗΗU+0397
ËËU+00CB
ΓΓU+0393
^^U+005E
ÍÍU+00CD
ÎÎU+00CE
ÌÌU+00CC
ΙΙU+0399
ÏÏU+00CF
ΚΚU+039A
ΛΛU+039B
ΜΜU+039C

 U+000A
ÑÑU+00D1
ΝΝU+039D
ŒŒU+0152
ÓÓU+00D3
ÔÔU+00D4
ÒÒU+00D2
ΩΩU+03A9
ΟΟU+039F
ØØU+00D8
ÕÕU+00D5
ÖÖU+00D6
ΦΦU+03A6
ΠΠU+03A0
″″U+2033
ΨΨU+03A8
ΡΡU+03A1
ŠŠU+0160
ΣΣU+03A3
ÞÞU+00DE
	 U+0009
ΤΤU+03A4
ΘΘU+0398
ÚÚU+00DA
ÛÛU+00DB
ÙÙU+00D9
ΥΥU+03A5
ÜÜU+00DC
ΞΞU+039E
ÝÝU+00DD

这个工具能做什么

  • 把用户输入或数据库里的文本塞进 HTML 页面时,先转义 & < > 引号,避免内容被当成标签执行。
  • 看别人给的 HTML 源码里 &nbsp;、&#x4F60;、&mdash; 到底代表什么字符,一键反转义成可读文本。
  • 生成 XML / RSS / 邮件模板时把非 ASCII 字符全部转成数字实体,保证在只认 ASCII 的老系统里不乱码。
  • 做前端字符串拼接调试:保留已有实体(不重复转义)可以安全地对一段已经部分转义的文本再处理一次。

示例

输入

<a href="x">Tom & Jerry</a>

输出

&lt;a href=&quot;x&quot;&gt;Tom &amp; Jerry&lt;/a&gt;

默认是「仅特殊字符」范围:& < > " ' 都会被转成实体,中文等其他字符保持原样。要连中文一起转,把范围切成「全部非 ASCII 字符」。

常见问题

为什么中文没有被转义?

默认的「仅特殊字符」范围只处理 & < > 与两种引号,这些才是会破坏 HTML 结构的字符。中文在 UTF-8 页面里本来就安全,想全部转成数字实体请把范围改成「全部非 ASCII 字符」。

&amp; 被重复转义成 &amp;amp; 了怎么办?

勾选「保留已有的实体」即可,工具会识别 &amp;、&copy;、&#169;、&#xA9; 这类已经写好的引用并原样跳过。不勾选时它会把 & 当成普通字符处理,这正是标准转义的行为。

命名实体、十进制和十六进制有什么区别?

三者渲染结果完全一样,只是写法不同。命名实体(&copy;)可读性最好但数量有限;十进制(&#169;)兼容性最广;十六进制(&#xA9;)在 XML 与部分老编辑器里更常见。转义时没有对应命名实体的字符会自动退回十进制。

反转义遇到 &#0; 或 &#xD800; 会怎样?

会直接报错,因为 U+0000 和代理区码位(U+D800–U+DFFF)都不是合法的 Unicode 标量值,无法还原成字符。其他无法识别的引用(比如拼错的 &foo;)会原样保留。

这里收录了多少命名实体?

共 281 条常用的 WHATWG 命名实体,覆盖拉丁字母、希腊字母、数学符号、箭头、货币与标点。HTML5 规范里的完整列表有 2000 多条,冷门条目这里查不到,可用数字实体替代。

关键词:html entitieshtml 实体escapeunescape转义反转义&amp;&nbsp;html encodehtml decode

同类工具