HTML 实体转换

HTML 实体转换,是指把 < > & " 换成 &lt;、&gt;、&amp;、&quot; 这类 & 开头分号结尾的写法,让代码片段原样显示在网页上;也能把 &nbsp;、&#39;、&#x4e2d; 等实体还原成原字符。免费在线使用,命名与数值实体混排一次认全,&amp;lt; 这种双重转义会被点名,解不开的原样保留并说明原因。全程字符串扫描、不渲染 HTML,浏览器本地计算、文本不上传。

拖入 .html / .xml / .txt 文件,点击选择
文本不上传 · 浏览器本地转换 · 也可直接粘贴 · 单文件 ≤ 10 MB
一键预设
转换方向

两个方向各自记住自己的输入框内容,来回切不丢文本。

自定义(字符 → 实体)

安全最小集(默认)只转 & < > " ' 这 5 个字符。适合把用户输入或代码片段安全塞进 HTML,含属性值

🔒 全部转换在你的浏览器本地用 JS 完成,文本不上传任何服务器,也不写入本地存储(只记住方向、 范围、写法这些参数偏好),关闭页面即清除。本工具只在「字符」与「它的实体写法」之间互转: 一个标签都不动、不改空白、不改换行、不删不可见字符,解不开的实体一律原样保留并说明原因。转义能让代码原样显示,但它不是安全过滤器:本页不判断哪个标签危险,服务端仍要做自己的校验。

想把标签整个去掉、只留正文,用 去除 HTML 标签;想把零宽空格、 不换行空格直接删掉而不是让它们现形,用 富文本清理; 要做的是码点转义(\u4e2d、U+4E2D)而不是实体,用 Unicode 转换

如何使用HTML 实体转换

1

HTML 实体转换怎么用:把要处理的文本粘进上方输入框,或直接拖入 .html / .xml / .txt 文件(文本只在你的浏览器里处理、不上传)。不确定怎么开始就点「填入示例」先看效果。

2

选方向和预设:默认就是「代码贴进网页」预设,即字符转实体、只转 < > & 与两种引号这个安全最小集,中文和英文原样可读。要还原就点「一键还原实体」,命名实体与 &#39;、&#x4e2d; 这类数值实体混排也能一次认全;也可以自己在下拉里挑范围(所有有命名实体的字符 / 非 ASCII 全转 / 只转不可见字符)、写法(命名优先 / 十进制 / 十六进制)和口径(HTML5 / HTML 4.01 / XML)。

3

拿结果:统计条会直接告诉你转了多少个字符、有没有解不开的实体;检测到 &amp;lt; 这类双重转义时,页面顶部会给出「只解一层」与「解到底」两个一键切换。结果可一键复制或下载 .txt(可选带 BOM,Windows 记事本打开不乱码),下方的常用实体速查表还能按名字、字符或码点搜索并逐条复制。

关于HTML 实体转换的常见问题

HTML 实体转换会上传我粘贴的内容吗?
不会,HTML 实体转换不上传任何内容。所有转换都在你的浏览器里用 JavaScript 完成,粘贴的文本、上传的文件内容与转换结果都不会发送到任何服务器,关闭页面即清除。本页只把方向、预设、范围、写法、口径、单引号与 BOM 这类参数偏好写进本机 localStorage,原文与结果一个字都不落盘,也不会把文本同步到网址里。想自证很简单:打开 F12 的网络面板再转一次,计算过程零请求,断开网络照样出结果(页面本身会加载一个访问统计脚本,它不读取也不上报你粘贴的内容)。
&lt; &gt; &amp; 是什么意思?怎么还原成符号?
它们是 HTML 实体,也叫字符实体引用:一段以 & 开头、以分号结尾的写法,用来在网页源码里表示那些直接写会被解析器误会的字符。&lt; 代表小于号,&gt; 代表大于号,&amp; 代表和号本身。之所以要这么写,是因为浏览器看到裸的小于号就会开始猜后面是不是标签名。要还原,把整段文本粘进本页、点「一键还原实体」即可,命名实体与 &#39;、&#x4e2d; 这类数值实体混在一起也能同时认出来,其余字符一个都不动。
HTML 代码怎么原样显示在网页上?
把代码粘进本页,用默认的「代码贴进网页」预设转一遍,再把结果放进文章或 pre 标签里即可:小于号、大于号、和号与两种引号会变成实体,浏览器于是把它们当成普通文字画出来,而不是当成标签执行。要提醒一句:转义能让代码原样显示,但它不是安全过滤器,本页不判断哪个标签危险、也不会替你删掉 script,服务端仍然要做自己的校验与白名单。把转义说成防 XSS 神器是过度承诺。
网址里的 & 要不要转义成 &amp;?
要转。HTML 属性里的和号是实体的开头字符,浏览器会先按实体规则去读它:<a href="p?a=1&copy=2"> 里的 &copy 命中 HTML5 那份可以省略分号的历史清单(106 条),被解析成版权号 ©,地址于是悄悄变成 p?a=1©=2,还不报任何错。参数名带 copy、reg、times、not 的链接最容易中招。正确写法是把和号转成 &amp;,也就是 <a href="p?a=1&amp;copy=2">,浏览器解析完拿到的仍是原来那个地址。把这段链接粘进本页用默认预设转一遍就是这个结果。要区分清楚的是:这与 URL 编码是两件事,把中文、空格转成 %E4%B8%AD 这种百分号编码请用 URL 编码解码,本页遇到 %XX 原样不动、也不报错。
&nbsp; 是什么意思?怎么去掉?
&nbsp; 是不换行空格,码点 U+00A0。&nbsp; 怎么去掉这件事要先说清楚:本页只帮你把它显形,不替你删。它长得和普通空格一模一样,却是另一个字符,所以在 Excel 里查找不到、在代码里匹配不上、导进数据库时对不上。它多半来自网页排版、Word 或 PDF 复制。本页的「只转不可见字符」范围会把它连同零宽空格、各种窄空格、BOM 一起转成实体让你看见它们在第几行第几列,但一个字符都不会替你删;真要清掉请用富文本清理。
&amp;lt; 这种双重转义怎么还原成 <?
这是数据被转义了两次的典型形状,成因通常是存库前转义了一次、渲染前又转义了一次。本页默认只解一层,所以 &amp;lt; 解出来是字面的 &lt; 而不是小于号,这是刻意的安全语义:一路解到底正是双重解码漏洞的形状。页面检测到这种模式时会在顶部弹出提示,并给「只解一层」与「解到底」两个一键切换。判断标准很简单:如果解一层之后你看到的还是实体写法,那就是被转了两次,再解一层即可,最多 8 轮。
HTML 实体转换和去除 HTML 标签有什么区别?
目标正相反。去除 HTML 标签是把标签扔掉、只留正文文字,适合把网页内容变成纯文本;本页一个标签都不动,只是把字符换成它的实体写法,转义后的 b 标签还是完整的 b 标签,只不过变成了看得见的字。一句话:那边是不要标签,这边是标签要,但要变成看得见的字。两者可以串着用,先在那边去标签、再来这边转义,也可以反过来。
单引号该转成 &apos; 还是 &#39;?
默认用 &#39; 最稳。&apos; 是 XML 和 HTML5 才有的名字,HTML 4.01 的实体集里从来没有定义过它,IE8 之类的老环境会把 &apos; 原样显示成五个字符。而 &#39; 是数值字符引用,只要是能解析 HTML 的东西都认得。本页把它做成了一个开关,选 HTML 4.01 口径时这个开关会被口径否决并自动回落到数值写法,不会让你在不知情的情况下产出一段老浏览器读不懂的 HTML。
XML 里为什么只能用 5 个 HTML 实体?
XML 规范只预定义了 amp、lt、gt、quot、apos 这五个实体,其余名字都要靠 DTD 声明才存在。所以 &nbsp; 写进一份裸 XML(比如 RSS、SVG 或配置文件)里,解析器会直接报未定义实体的错误,而不是显示成空格。本页的 XML 口径就是为这件事准备的:选上之后,除这五个之外的字符一律回落成数值实体,&nbsp; 会变成 &#160;,任何 XML 解析器都能读。
汉字转 HTML 实体用 &#20013; 还是 &#x4e2d;?
两种都对,指的是同一个汉字,区别只是十进制与十六进制两种写法。十六进制和 Unicode 码点表对得上,看起来更好核对;十进制在一些很老的系统里更保险。汉字没有命名实体,所以只能用这两种数值写法,本页的「非 ASCII 全转」范围加上写法下拉就能一键产出。顺带说清边界:如果你要的是源码里的 \u4e2d 或文档里的 U+4E2D,那是码点转义,请用 Unicode 转换,本页只管 & 开头分号结尾的这一族。
&#128; 是什么符号?为什么解出来是欧元?
因为 HTML5 规范对 &#128; 到 &#159; 这一段数值引用有一条特殊规定:不按码点解,而是按 Windows-1252 的对应字符解。&#128; 于是变成欧元符号而不是 U+0080 控制字符,&#146; 变成右单引号,&#151; 变成长破折号。这正是从 Word 复制过来的文字里那些弯引号的来龙去脉。浏览器就是这么干的,本页默认跟随,但每一处都会在下面的列表里逐条告诉你,也可以在选项里关掉、改成如实按码点解。
手机上能做 HTML 实体编码解码吗?
可以。本页在手机浏览器里同样是本地计算,不依赖任何服务端接口,输入区与结果区会自动改成上下堆叠,下拉用系统原生控件,速查表降级成可横向滚动的表格,不会横着溢出屏幕。粘贴、复制、下载 txt 都能用。唯一要留意的是超长文本:手机内存有限,建议单次控制在几十万字以内,超过 20 万字页面会自动切换成点按钮加进度条、可随时取消的分片计算模式。
HTML 实体转换有字数限制吗?能传文件吗?
完全免费、无需注册、不限次数。可以直接拖入 .html、.xml、.svg、.txt、.json、.md、.log 等纯文本文件,单文件上限 10 MB,超过会直接提示你拆分而不是硬扛。文本上限是 500 万字,超过 20 万字会自动切换成分片计算并显示进度、可随时取消;真的超过 500 万字上限会明确告诉你已处理到哪里,不会静默丢内容。结果超过 5000 行时文本框只渲染前 5000 行做预览,但复制和下载拿到的始终是完整数据。
转义后的 HTML 实体会执行 JS 吗?安全吗?
本页自身是安全的:它全程只做字符串扫描,不渲染 HTML、不建 DOM、不用 innerHTML,也不提供渲染预览,所以你粘进来的东西不可能在本页里执行。至于转义后的结果安不安全,要看你怎么用:把转义后的文本作为纯文本插进页面是安全的,但如果你的代码又把它当 HTML 拼回去、或者解码两次再输出,风险就回来了。本页只承诺如实转换,不承诺替你做 XSS 防护,服务端的校验与白名单不能省。
遇到不认识的 HTML 实体会被删掉吗?
不会,这是本工具的一条硬规矩。本页收录了 308 个常用命名实体,而 HTML5 规范里一共有 2231 条,剩下的绝大多数是数学排版专用、在真实网页里几乎不会出现。遇到表外的名字、越界码点、落在代理区的码点、缺分号或空的数值实体,一律原样保留,并在下面的列表里给出行号、列号、原文与原因。绝不会用替换字符糊过去,也绝不会猜一个字符给你——那会让你拿着一段悄悄坏掉的文本走。

HTML 实体 &lt;、&amp;、&nbsp; 分别是什么意思

先把最常被搜的两句说清楚:尖括号怎么在网页上显示——把它写成实体就行;&lt; 怎么变成 <,靠的就是 「解码」这一步——把实体写法还原成字符本身。反过来把 < 写成 &lt; 就是转义。两个细节最容易翻车:HTML 实体缺分号时浏览器有时能容错、 有时不能(&ltx 就不会被当成小于号),所以本页一律补齐分号; HTML 实体大小写敏感吗——命名实体敏感的,&COPY;&copy; 在 HTML5 里不是一回事。单引号同理,&#39; 怎么还原都没问题,但 &apos; 在老 IE 上会原样显示。

一句话:实体是写给解析器看的写法,不是给人看的字符。网页源码是纯文本, 浏览器靠小于号判断标签的开头、靠和号判断实体的开头。所以当你真的想显示一个小于号时, 就必须换一种写法告诉解析器「这是个普通字符,别当标签」——这就是 HTML 实体。它以 & 开头、以分号结尾,中间要么是一个名字,要么是一个数字。

五个基础实体:把代码原样显示在网页上时真正要转的就是它们
实体字符十进制十六进制为什么要转
&lt;<&#60;&#x3c;小于号。裸写在网页里可能被当成标签开头
&gt;>&#62;&#x3e;大于号。与小于号成对转义最省心
&amp;&&#38;&#x26;和号。它是所有实体的开头字符,所以必须最先转
&quot;"&#34;&#x22;双引号。往属性值里塞用户输入时不转就能直接闭合属性
&apos;'&#39;&#x27;单引号。HTML 4.01 里没有这个名字,本页默认输出数值写法

这五个就是本页默认的「安全最小集」。真实需求几乎从来不是把每个字符都转一遍—— 把整段中文也转成 &#20013; 只会让源码没法读,还徒增体积。所以本页把 范围做成了一个独立开关,它比写法开关更影响可用性。

换个每天都在发生的算例:链接 <a href="p?a=1&copy=2">链接</a> 里的和号不转,&copy 会命中 HTML5 那份「可以省略分号」的历史清单被读成 ©,地址悄悄变成 p?a=1©=2 且不报任何错—— 参数名带 copy、reg、times、not 的链接最容易中招。用本页默认预设转一遍得到 &lt;a href=&quot;p?a=1&amp;copy=2&quot;&gt;链接&lt;/a&gt;,一共动了 7 个字符, 中文与路径一个字不动。

HTML 实体的三种写法:命名、十进制、十六进制

三种写法里,命名实体最好认,十进制实体与十六进制实体则是「按码点写」:同一个「中」字, 十进制实体是 &#20013;,十六进制实体是 &#x4e2d;。 所以把 &#20013; 转中文得到的就是「中」;问 &#x4e2d; 是什么,答案也是同一个字,只是进制不同。中文转 HTML 实体、HTML 实体转中文这两个方向本页各选一次「编码」「解码」即可, 三种写法都认。

同一个字符往往有三种合法写法,它们指的是同一个码点,区别只在出处与兼容性。&copy; 是命名实体,好记但要求对方认得这个名字;&#169;&#xa9; 是数值字符引用,直接写码点, 只要能解析 HTML 就一定认得。

同一个字符的三种写法:命名实体不是每个字符都有,数值写法永远有
字符命名实体十进制十六进制说明
©&copy;&#169;&#xa9;有命名实体,三种写法等价
不换行空格&nbsp;&#160;&#xa0;看不见,但它不是普通空格,搜索与比对都对不上
(无命名实体)&#20013;&#x4e2d;汉字没有命名实体,只能用数值写法
😀(无命名实体)&#128512;&#x1f600;emoji 是一个码点,输出也只有一段

注意「中」那一行:汉字没有命名实体,所以命名优先这一档遇到中文会自动 回落成数值写法。本页收录了 308 个常用命名实体,而 HTML5 规范里一共有 2231 条。剩下那 1900 多条绝大多数是数学排版专用(最长的一条叫 CounterClockwiseContourIntegral,31 个字母),在真实网页里的出现频次接近 0,把它们全塞 进首屏只会让每个访客都为几乎用不到的数据买单。处理方式是如实告知而不是猜:解码遇到表外名字会原样保留并点名,如果它其实是数值实体,本页一定认得。

&amp;lt; 这种双重转义怎么还原

HTML 双重转义是指一段文本被转义了两次:< 先变成 &lt;,其中的 & 又被转成 &amp;, 于是屏幕上出现 &amp;lt;。常见于三个场景——网页显示 &lt; 怎么办、数据库里的 &nbsp; 怎么处理, 以及转义后的 HTML 怎么还原回原样。&amp;lt; 怎么还原? 解码一次得到 &lt;,再解一次才是 <, 本页的「解码次数」就是干这个的。

从数据库或接口里捞出来的文本满屏 &amp;nbsp;、页面上直接显示出 &lt;div&gt; 这几个字——这是同一个问题:数据被转义了两次。 常见成因是存库前框架转了一次、模板渲染前又转了一次,两次都没错,错的是叠在了一起。

解一层还是解到底:先看解一层之后长什么样再决定
原文解一层的结果解到底的结果该选哪个
&amp;lt;&lt;<解一层后还是实体写法,说明被转了两次,再解一层
&lt;<<只被转了一次,解一层就到位,不要再解

HTML5、HTML 4.01 与 XML 的实体口径差异

XML 转义字符只有五个:XML 五个预定义实体分别是 &lt;&gt;&amp;&quot; &apos;,除此之外都要写成码点形式。HTML5 命名实体则有两千多个, 两边口径不同,选错档就会出现「在浏览器里好好的,喂给 XML 解析器就报错」。

同一个 &nbsp; 在三种口径下的命运完全不同,这是别的在线实体工具基本 不提、却最容易让人踩坑的一条。

三种规范口径分别允许哪些命名实体
口径允许的命名实体为什么要有这一档
HTML5(默认)表内全部命名实体现代网页,什么都能用
HTML 4.01表内减去 HTML5 新增的名字(含 &apos;)&apos; 不在 HTML 4.01 实体集里,IE8 会把它原样显示成五个字符
XML / RSS / SVG只有 &amp; &lt; &gt; &quot; &apos; 五个XML 只有 5 个预定义实体,&nbsp; 在裸 XML(无 DTD)里是未定义实体,解析器直接报错

最实际的两条结论:一,写 XML、RSS、SVG 或任何没有 DTD 的 XML 文档时, &nbsp; 会让解析器直接报未定义实体的错,必须写成 &#160;;本页的 XML 口径就是替你把这件事一次做对,选上之后 除了那五个预定义实体,其余字符一律回落成数值写法。二,单引号在 HTML 4.01 里没有 &apos; 这个名字,所以本页默认输出 &#39;; 勾了「单引号用 &apos;」再切到 HTML 4.01 口径,开关会被口径否决并给出说明。

&#128; 为什么解出来是欧元符号

按码点算,&#128; 应该是 U+0080 这个控制字符。但 HTML5 规范专门规定:&#128; 到 &#159; 这一段数值引用不按码点解,而是按 Windows-1252 重映射。 浏览器就是这么干的,本页默认跟随——不然你会得到一段和浏览器渲染结果不一致的文本,那比报错更危险。

Windows-1252 重映射节选:从 Word 复制过来的文字里那些弯引号的来龙去脉
数值实体实际字符真实码点命名写法
&#128;U+20AC&euro;
&#133;U+2026&hellip;
&#145;U+2018&lsquo;
&#146;U+2019&rsquo;
&#147;U+201C&ldquo;
&#148;U+201D&rdquo;
&#150;U+2013&ndash;
&#151;U+2014&mdash;
&#153;U+2122&trade;

这段规则的历史来自 Windows 上的老编辑器:它们把 0x80 到 0x9F 这段本该是控制字符的区间 用来放欧元号、弯引号和破折号,于是网上大量老页面写着 &#146; 却想显示右单引号。 规范为了兼容这些页面,把这条行为写了进来。本页把每一处重映射都当成提示级条目列出来, 让你知道工具做了什么;如果你要的是如实按码点解,把选项里的开关关掉即可。 顺带一提:0x81、0x8D、0x8F、0x90、0x9D 这五个位置在 Windows-1252 里没有定义,规范也没有 对应项,本页照码点解,不替它们编一个字符出来。

六档转义范围怎么选:HTML 实体不必全转

把用户输入安全地塞进 HTML 时,你要的是「中文和英文照样能读、只有那几个危险字符变成实体」, 而不是把每个字符都转一遍。范围开关就是干这个的。

六档范围各转什么、适合什么场景
范围转什么典型场景
安全最小集(默认)只转 & < > " ' 这 5 个字符把用户输入或代码片段安全塞进 HTML,含属性值
只转尖括号与和号只转 & < > 这 3 个字符,引号保持可读只往文本节点里塞内容,不进属性值
所有有命名实体的字符查表命中就转:© × — … ← α é 都会变成命名实体老邮件模板、只认 ASCII 的 CMS、导出给旧系统
非 ASCII 全转U+0080 及以上一律转:中文、日韩文、emoji、全角标点纯 ASCII 传输通道;中文按写法输出 &#20013; 或 &#x4e2d;
只转不可见字符零宽字符、NBSP、各种窄空格、BOM、控制字符、变体选择符排查「肉眼一样却匹配不上」,与富文本清理的「删掉它们」互为镜像
全部字符每个码点都转,英文字母与数字也不例外逐字符检查、极端兼容场景

其中「只转不可见字符」是本页的第二个杀手锏:零宽空格、不换行空格、各种窄空格、BOM、 方向控制符、变体选择符会被转成实体现形出来,一眼就能看到多出来的是什么、 在第几行第几列,而中文和英文一个字都不会动。这正是「两段看起来一模一样的字符串就是不相等」 「Excel 里查找不到」的头号原因。本页只让它们现形、不替你删;要清掉请用富文本清理。 另外,制表符与换行刻意不算不可见字符——把换行也算进去会让整篇文本的换行全变成 &#10;,真正要找的那个零宽空格反而被淹没。

下面这段是各档范围对同一个探针 <©中 的真实产出,直接由本页的转换实现算出来, 不是手抄的:

同一段探针在六档范围下的真实产出
范围<©中 的产出
安全最小集(默认)&lt;©中
只转尖括号与和号&lt;©中
所有有命名实体的字符&lt;&copy;中
非 ASCII 全转<&copy;&#20013;
只转不可见字符<©中
全部字符&lt;&copy;&#20013;

常用 HTML 实体速查表:按名字、字符或码点查

查得最多的几个可以先在这里对一下:空格 HTML 代码是 &nbsp;(码点 160, 所以 &#160; 是什么——就是它);版权符号 HTML 代码是 &copy;,问 &copy; 是什么意思,答案是 ©;&quot; 是什么意思——双引号 "。 其余特殊符号 HTML 代码都能在下表按名字、字符或码点查。

308 个常用命名实体按 9 类整理,每条都给出实体名、字符、十进制与十六进制四种写法, 可以按名字、字符或码点搜索,也能逐条或整组复制。表里的四种写法与本页的转换实现共用同一份数据、 同一个出口,所以你在这里看到的写法和你按下按钮拿到的结果永远一致。

共收录 308 个常用命名实体;四种写法都由本页的转换实现现算,与结果永远一致。

基础标记9)—— 把代码原样显示在网页上时真正要转的那几个字符
实体字符十进制十六进制说明
&amp;&&#38;&#x26;和号。转义方向必须最先处理它,否则 < 会被二次转义成 &amp;lt;
&lt;<&#60;&#x3c;小于号。网页里出现裸 < 就可能被解析器当成标签开头
&gt;>&#62;&#x3e;大于号。与 < 成对转义,&gt; 单独出现其实是安全的,但一起转更省心
&quot;"&#34;&#x22;双引号。往 HTML 属性值里塞用户输入时必须转,否则能直接闭合属性
&apos;'&#39;&#x27;HTML 4.01 里没有这个名字,IE8 会把它原样显示成五个字符;默认输出 &#39;
&AMP;&&#38;&#x26;
&LT;<&#60;&#x3c;
&GT;>&#62;&#x3e;
&QUOT;"&#34;&#x22;
空格与不可见14)—— 看不见却实实在在存在的字符,是「搜不到、匹配不上」的头号原因
实体字符十进制十六进制说明
&nbsp;&#160;&#xa0;不换行空格 U+00A0。看着是空格,但搜索、Excel 查找、数据库导入统统对不上
&ensp;&#8194;&#x2002;半角空格,宽度约等于一个 n
&emsp;&#8195;&#x2003;全角空格,宽度约等于一个 m
&emsp13;&#8196;&#x2004;三分之一 em 宽的空格
&emsp14;&#8197;&#x2005;四分之一 em 宽的空格
&numsp;&#8199;&#x2007;数字空格,宽度与一个数字相同,用于表格数字对齐
&puncsp;&#8200;&#x2008;标点空格,宽度与一个句点相同
&thinsp;&#8201;&#x2009;窄空格,常用于数字与单位之间
&hairsp;&#8202;&#x200a;发丝空格,比窄空格还窄
&zwnj;&#8204;&#x200c;零宽不连字。完全看不见,却让两段「一模一样」的文字比对不相等
&zwj;&#8205;&#x200d;零宽连字。组合 emoji(👨‍👩‍👦)中间就有它
&lrm;&#8206;&#x200e;从左到右标记,方向控制符
&rlm;&#8207;&#x200f;从右到左标记,方向控制符
&shy;&#173;&#xad;软连字符。PDF、Word 为了行末断词插入,复制出来就成了单词里的隐形字符
标点排版32)—— 破折号、省略号、弯引号、角标——从 Word 复制过来的文字里最多的一类
实体字符十进制十六进制说明
&ndash;&#8211;&#x2013;短破折号,用于数字区间 1–9
&mdash;&#8212;&#x2014;长破折号,中文里的「——」是两个它
&horbar;&#8213;&#x2015;水平横线,比长破折号更长
&lsquo;&#8216;&#x2018;左单引号。Word 的「智能引号」会把直角引号自动换成它
&rsquo;&#8217;&#x2019;右单引号。英文里的撇号 don’t 用的就是它,不是 ASCII 的 '
&sbquo;&#8218;&#x201a;下单引号
&ldquo;&#8220;&#x201c;左双引号
&rdquo;&#8221;&#x201d;右双引号
&bdquo;&#8222;&#x201e;下双引号,德文引号的下半
&dagger;&#8224;&#x2020;剑号,脚注标记
&Dagger;&#8225;&#x2021;双剑号,第二级脚注标记
&bull;&#8226;&#x2022;实心圆点,无序列表的项目符号
&nldr;&#8229;&#x2025;两点前导符
&hellip;&#8230;&#x2026;省略号。中文的「……」是两个它
&mldr;&#8230;&#x2026;
&prime;&#8242;&#x2032;角分 / 英尺符号,不是 ASCII 的单引号
&Prime;&#8243;&#x2033;角秒 / 英寸符号,不是 ASCII 的双引号
&tprime;&#8244;&#x2034;三重撇号
&permil;&#8240;&#x2030;千分号
&pertenk;&#8241;&#x2031;万分号
&oline;&#8254;&#x203e;上划线
&frasl;&#8260;&#x2044;分数斜线,写 1⁄2 这种分数用
&hybull;&#8259;&#x2043;连字符项目符号
&lsaquo;&#8249;&#x2039;单左尖括号引号
&rsaquo;&#8250;&#x203a;单右尖括号引号
&laquo;«&#171;&#xab;左书名号,法俄文的引号
&raquo;»&#187;&#xbb;右书名号
&iexcl;¡&#161;&#xa1;倒感叹号,西班牙语句首用
&iquest;¿&#191;&#xbf;倒问号,西班牙语句首用
&sect;§&#167;&#xa7;章节号
&para;&#182;&#xb6;段落标记
&middot;·&#183;&#xb7;间隔号。中文人名里的「·」通常是 U+00B7
货币符号5)—— 欧元、英镑、日元这类只认 ASCII 的通道里必须转义的符号
实体字符十进制十六进制说明
&cent;¢&#162;&#xa2;美分
&pound;£&#163;&#xa3;英镑
&curren;¤&#164;&#xa4;通用货币符号,不是具体某种货币
&yen;¥&#165;&#xa5;日元 / 人民币符号
&euro;&#8364;&#x20ac;欧元。&#128; 解出来就是它,见正文 Windows-1252 一节
数学与分数70)—— 乘除号、不等号、集合与分数,写文档和公式时常用
实体字符十进制十六进制说明
&minus;&#8722;&#x2212;真正的减号,比 ASCII 连字符 - 更宽
&times;×&#215;&#xd7;乘号,不是字母 x
&divide;÷&#247;&#xf7;除号
&plusmn;±&#177;&#xb1;正负号
&sup1;¹&#185;&#xb9;上标 1
&sup2;²&#178;&#xb2;上标 2,写平方米 m² 用
&sup3;³&#179;&#xb3;上标 3,写立方米 m³ 用
&frac14;¼&#188;&#xbc;
&frac12;½&#189;&#xbd;
&frac34;¾&#190;&#xbe;
&frac13;&#8531;&#x2153;
&frac23;&#8532;&#x2154;
&frac15;&#8533;&#x2155;
&frac18;&#8539;&#x215b;
&frac38;&#8540;&#x215c;
&frac58;&#8541;&#x215d;
&frac78;&#8542;&#x215e;
&fnof;ƒ&#402;&#x192;函数符号 ƒ。&#131; 按 Windows-1252 解出来就是它
&forall;&#8704;&#x2200;
&part;&#8706;&#x2202;偏微分
&exist;&#8707;&#x2203;
&empty;&#8709;&#x2205;空集
&nabla;&#8711;&#x2207;
&isin;&#8712;&#x2208;属于
&notin;&#8713;&#x2209;不属于。&notin 在无分号容错下会被拆成 &not + in,见正文
&ni;&#8715;&#x220b;
&prod;&#8719;&#x220f;连乘
&coprod;&#8720;&#x2210;
&sum;&#8721;&#x2211;求和
&lowast;&#8727;&#x2217;
&radic;&#8730;&#x221a;根号
&prop;&#8733;&#x221d;
&infin;&#8734;&#x221e;无穷
&ang;&#8736;&#x2220;
&and;&#8743;&#x2227;
&or;&#8744;&#x2228;
&cap;&#8745;&#x2229;交集
&cup;&#8746;&#x222a;并集
&int;&#8747;&#x222b;积分
&oint;&#8750;&#x222e;
&there4;&#8756;&#x2234;所以
&because;&#8757;&#x2235;因为
&mid;&#8739;&#x2223;
&parallel;&#8741;&#x2225;
&sim;&#8764;&#x223c;
&cong;&#8773;&#x2245;
&asymp;&#8776;&#x2248;约等于
&ne;&#8800;&#x2260;不等于
&equiv;&#8801;&#x2261;恒等于
&le;&#8804;&#x2264;小于等于
&ge;&#8805;&#x2265;大于等于
&sub;&#8834;&#x2282;
&sup;&#8835;&#x2283;
&nsub;&#8836;&#x2284;
&nsup;&#8837;&#x2285;
&sube;&#8838;&#x2286;
&supe;&#8839;&#x2287;
&oplus;&#8853;&#x2295;
&otimes;&#8855;&#x2297;
&perp;&#8869;&#x22a5;垂直
&sdot;&#8901;&#x22c5;点乘
&lceil;&#8968;&#x2308;
&rceil;&#8969;&#x2309;
&lfloor;&#8970;&#x230a;
&rfloor;&#8971;&#x230b;
&loz;&#9674;&#x25ca;菱形
&weierp;&#8472;&#x2118;
&image;&#8465;&#x2111;虚部符号
&real;&#8476;&#x211c;实部符号
&alefsym;&#8501;&#x2135;
箭头17)—— 单双线四方向箭头,流程说明与文档里最常用
实体字符十进制十六进制说明
&larr;&#8592;&#x2190;
&uarr;&#8593;&#x2191;
&rarr;&#8594;&#x2192;右箭头,写「A → B」用
&darr;&#8595;&#x2193;
&harr;&#8596;&#x2194;
&varr;&#8597;&#x2195;
&nwarr;&#8598;&#x2196;
&nearr;&#8599;&#x2197;
&searr;&#8600;&#x2198;
&swarr;&#8601;&#x2199;
&crarr;&#8629;&#x21b5;回车箭头
&lArr;&#8656;&#x21d0;注意大小写:lArr 是双线箭头,larr 是单线
&uArr;&#8657;&#x21d1;
&rArr;&#8658;&#x21d2;
&dArr;&#8659;&#x21d3;
&hArr;&#8660;&#x21d4;
&vArr;&#8661;&#x21d5;
希腊字母52)—— 大小写各一套,物理、数学与工程文档的常客
实体字符十进制十六进制说明
&alpha;α&#945;&#x3b1;
&beta;β&#946;&#x3b2;
&gamma;γ&#947;&#x3b3;
&delta;δ&#948;&#x3b4;
&epsilon;ε&#949;&#x3b5;
&zeta;ζ&#950;&#x3b6;
&eta;η&#951;&#x3b7;
&theta;θ&#952;&#x3b8;
&iota;ι&#953;&#x3b9;
&kappa;κ&#954;&#x3ba;
&lambda;λ&#955;&#x3bb;
&mu;μ&#956;&#x3bc;希腊字母 μ(U+03BC),与「微」符号 µ(U+00B5, &micro;)是两个不同的字符
&nu;ν&#957;&#x3bd;
&xi;ξ&#958;&#x3be;
&omicron;ο&#959;&#x3bf;
&pi;π&#960;&#x3c0;
&rho;ρ&#961;&#x3c1;
&sigmaf;ς&#962;&#x3c2;词尾用的 sigma
&sigma;σ&#963;&#x3c3;
&tau;τ&#964;&#x3c4;
&upsilon;υ&#965;&#x3c5;
&phi;φ&#966;&#x3c6;
&chi;χ&#967;&#x3c7;
&psi;ψ&#968;&#x3c8;
&omega;ω&#969;&#x3c9;
&Alpha;Α&#913;&#x391;
&Beta;Β&#914;&#x392;
&Gamma;Γ&#915;&#x393;
&Delta;Δ&#916;&#x394;
&Epsilon;Ε&#917;&#x395;
&Zeta;Ζ&#918;&#x396;
&Eta;Η&#919;&#x397;
&Theta;Θ&#920;&#x398;
&Iota;Ι&#921;&#x399;
&Kappa;Κ&#922;&#x39a;
&Lambda;Λ&#923;&#x39b;
&Mu;Μ&#924;&#x39c;
&Nu;Ν&#925;&#x39d;
&Xi;Ξ&#926;&#x39e;
&Omicron;Ο&#927;&#x39f;
&Pi;Π&#928;&#x3a0;
&Rho;Ρ&#929;&#x3a1;
&Sigma;Σ&#931;&#x3a3;
&Tau;Τ&#932;&#x3a4;
&Upsilon;Υ&#933;&#x3a5;
&Phi;Φ&#934;&#x3a6;
&Chi;Χ&#935;&#x3a7;
&Psi;Ψ&#936;&#x3a8;
&Omega;Ω&#937;&#x3a9;
&thetasym;ϑ&#977;&#x3d1;
&upsih;ϒ&#978;&#x3d2;
&piv;ϖ&#982;&#x3d6;
带音标拉丁字母69)—— 法德西北欧语言的重音字母,导出给只认 ASCII 的旧系统时要转
实体字符十进制十六进制说明
&Agrave;À&#192;&#xc0;
&Aacute;Á&#193;&#xc1;
&Acirc;Â&#194;&#xc2;
&Atilde;Ã&#195;&#xc3;
&Auml;Ä&#196;&#xc4;
&Aring;Å&#197;&#xc5;
&AElig;Æ&#198;&#xc6;
&Ccedil;Ç&#199;&#xc7;
&Egrave;È&#200;&#xc8;
&Eacute;É&#201;&#xc9;
&Ecirc;Ê&#202;&#xca;
&Euml;Ë&#203;&#xcb;
&Igrave;Ì&#204;&#xcc;
&Iacute;Í&#205;&#xcd;
&Icirc;Î&#206;&#xce;
&Iuml;Ï&#207;&#xcf;
&ETH;Ð&#208;&#xd0;
&Ntilde;Ñ&#209;&#xd1;
&Ograve;Ò&#210;&#xd2;
&Oacute;Ó&#211;&#xd3;
&Ocirc;Ô&#212;&#xd4;
&Otilde;Õ&#213;&#xd5;
&Ouml;Ö&#214;&#xd6;
&Oslash;Ø&#216;&#xd8;
&Ugrave;Ù&#217;&#xd9;
&Uacute;Ú&#218;&#xda;
&Ucirc;Û&#219;&#xdb;
&Uuml;Ü&#220;&#xdc;
&Yacute;Ý&#221;&#xdd;
&THORN;Þ&#222;&#xde;
&szlig;ß&#223;&#xdf;德语 ß
&agrave;à&#224;&#xe0;
&aacute;á&#225;&#xe1;
&acirc;â&#226;&#xe2;
&atilde;ã&#227;&#xe3;
&auml;ä&#228;&#xe4;
&aring;å&#229;&#xe5;
&aelig;æ&#230;&#xe6;
&ccedil;ç&#231;&#xe7;
&egrave;è&#232;&#xe8;
&eacute;é&#233;&#xe9;é 是一个码点 U+00E9;e + 组合重音符是两个码点,本页如实按两种结果输出
&ecirc;ê&#234;&#xea;
&euml;ë&#235;&#xeb;
&igrave;ì&#236;&#xec;
&iacute;í&#237;&#xed;
&icirc;î&#238;&#xee;
&iuml;ï&#239;&#xef;
&eth;ð&#240;&#xf0;
&ntilde;ñ&#241;&#xf1;
&ograve;ò&#242;&#xf2;
&oacute;ó&#243;&#xf3;
&ocirc;ô&#244;&#xf4;
&otilde;õ&#245;&#xf5;
&ouml;ö&#246;&#xf6;
&oslash;ø&#248;&#xf8;
&ugrave;ù&#249;&#xf9;
&uacute;ú&#250;&#xfa;
&ucirc;û&#251;&#xfb;
&uuml;ü&#252;&#xfc;
&yacute;ý&#253;&#xfd;
&thorn;þ&#254;&#xfe;
&yuml;ÿ&#255;&#xff;
&OElig;Œ&#338;&#x152;
&oelig;œ&#339;&#x153;
&Scaron;Š&#352;&#x160;
&scaron;š&#353;&#x161;
&Yuml;Ÿ&#376;&#x178;
&Zcaron;Ž&#381;&#x17d;
&zcaron;ž&#382;&#x17e;
符号杂项40)—— 版权、注册商标、度数、扑克花色、音符与几何形状
实体字符十进制十六进制说明
&copy;©&#169;&#xa9;版权符号
&COPY;©&#169;&#xa9;
&reg;®&#174;&#xae;注册商标符号
&REG;®&#174;&#xae;
&trade;&#8482;&#x2122;商标符号
&deg;°&#176;&#xb0;度数符号,写 25°C 用
&micro;µ&#181;&#xb5;微符号 µ(U+00B5),与希腊字母 μ(U+03BC, &mu;)是两个不同的字符
&brvbar;¦&#166;&#xa6;
&uml;¨&#168;&#xa8;
&ordf;ª&#170;&#xaa;
&ordm;º&#186;&#xba;
&not;¬&#172;&#xac;否定号。它在无分号历史清单里,所以 &notin 会被拆成 &not + in
&macr;¯&#175;&#xaf;
&acute;´&#180;&#xb4;
&cedil;¸&#184;&#xb8;
&circ;ˆ&#710;&#x2c6;抑扬符。&#136; 按 Windows-1252 解出来就是它
&tilde;˜&#732;&#x2dc;波浪符。&#152; 按 Windows-1252 解出来就是它
&spades;&#9824;&#x2660;
&clubs;&#9827;&#x2663;
&hearts;&#9829;&#x2665;
&diams;&#9830;&#x2666;
&sung;&#9834;&#x266a;八分音符
&flat;&#9837;&#x266d;
&natur;&#9838;&#x266e;
&sharp;&#9839;&#x266f;
&starf;&#9733;&#x2605;实心五角星
&star;&#9734;&#x2606;空心五角星
&phone;&#9742;&#x260e;
&female;&#9792;&#x2640;
&male;&#9794;&#x2642;
&check;&#10003;&#x2713;对勾
&cross;&#10007;&#x2717;
&blank;&#9251;&#x2423;可见的空格符号 ␣,本身是个正常字符,不是不可见字符
&squ;&#9633;&#x25a1;
&squf;&#9642;&#x25aa;
&rect;&#9645;&#x25ad;
&utrif;&#9652;&#x25b4;
&rtrif;&#9656;&#x25b8;
&dtrif;&#9662;&#x25be;
&ltrif;&#9666;&#x25c2;

HTML 实体转换能做什么、不做什么

本页的能力边界与对应的去处
事项本页的处理
转义方向6 档范围 × 3 种写法 × 3 种口径,单引号写法与十六进制大小写可单独选
还原方向命名实体与十进制、十六进制数值实体混排一次认全,默认只解一层
命名实体收录308 个常用项;规范里共 2231 条,表外的原样保留并点名,绝不猜
大小写命名实体大小写敏感,&Amp; 不等于 &amp;,认不出就原样保留
缺分号默认原样保留;打开历史清单容错后按 HTML5 的 106 条清单最长匹配
Windows-1252默认按规范重映射 &#128;–&#159; 并逐条提示,可关闭改成按码点解
去 HTML 标签不做。本页一个标签都不动,去标签请用「去除 HTML 标签」
美化 / 压缩 HTML不做,请用「HTML 格式化」;本页不改任何空白与换行
HTML 净化 sanitize不做。转义不等于安全过滤,本页不判断哪个标签危险,服务端仍要校验
渲染预览不做。本页不建 DOM、不用 innerHTML,粘进来的东西不可能在本页执行
码点转义不做 \u4e2d、U+4E2D、%u4E2D,请用「Unicode 转换」
URL 百分号编码不做 %E4%B8%AD,请用「URL 编码解码」;遇到它本页原样不动也不报错
NFC / NFD / NFKC 归一不做。é 与 e 加组合重音符是两串不同码点,本页如实按两种结果输出
八进制与裸数字不做。20013 到底是码点还是数字无法判断,一律不动
单次上限500 万字或 10 MB;超过 20 万字自动分片并显示进度、可取消
网络请求与落盘零请求;只把方向、范围、写法等参数偏好记在本机,原文与结果不落盘

这件事在中文里叫法很杂:HTML 转义与 HTML 反转义、HTML 实体解码、HTML 转义字符、 HTML 字符实体、HTML 特殊字符转义,按场景又叫在线 HTML 转义工具、HTML 转义在线、 HTML 实体转换器、HTML 实体在线转换、HTML 实体转换在线——说的都是同一件事: 在字符与实体之间来回换。要按符号反查名字,本页下方的 HTML 实体对照表支持按名字、 字符或码点三种查法。

英文语境下这类工具通常叫 html entity encoder、html escape online、html unescape online 或 html unescape, 搜 encode html entities、html entity decoder 找到的都是同一件事。要按名字找一个符号 (比如「℃ 怎么打」)请用「特殊符号大全」;要把整段 HTML 变成纯文本请用「去除 HTML 标签」; 要把粘贴过来的富文本连同零宽字符一起清干净请用「富文本清理」。