HTML 实体转换
HTML 实体转换,是指把 < > & " 换成 <、>、&、" 这类 & 开头分号结尾的写法,让代码片段原样显示在网页上;也能把 、'、中 等实体还原成原字符。免费在线使用,命名与数值实体混排一次认全,&lt; 这种双重转义会被点名,解不开的原样保留并说明原因。全程字符串扫描、不渲染 HTML,浏览器本地计算、文本不上传。
🔒 全部转换在你的浏览器本地用 JS 完成,文本不上传任何服务器,也不写入本地存储(只记住方向、 范围、写法这些参数偏好),关闭页面即清除。本工具只在「字符」与「它的实体写法」之间互转: 一个标签都不动、不改空白、不改换行、不删不可见字符,解不开的实体一律原样保留并说明原因。转义能让代码原样显示,但它不是安全过滤器:本页不判断哪个标签危险,服务端仍要做自己的校验。
想把标签整个去掉、只留正文,用 去除 HTML 标签;想把零宽空格、 不换行空格直接删掉而不是让它们现形,用 富文本清理; 要做的是码点转义(\u4e2d、U+4E2D)而不是实体,用 Unicode 转换。
如何使用HTML 实体转换
HTML 实体转换怎么用:把要处理的文本粘进上方输入框,或直接拖入 .html / .xml / .txt 文件(文本只在你的浏览器里处理、不上传)。不确定怎么开始就点「填入示例」先看效果。
选方向和预设:默认就是「代码贴进网页」预设,即字符转实体、只转 < > & 与两种引号这个安全最小集,中文和英文原样可读。要还原就点「一键还原实体」,命名实体与 '、中 这类数值实体混排也能一次认全;也可以自己在下拉里挑范围(所有有命名实体的字符 / 非 ASCII 全转 / 只转不可见字符)、写法(命名优先 / 十进制 / 十六进制)和口径(HTML5 / HTML 4.01 / XML)。
拿结果:统计条会直接告诉你转了多少个字符、有没有解不开的实体;检测到 &lt; 这类双重转义时,页面顶部会给出「只解一层」与「解到底」两个一键切换。结果可一键复制或下载 .txt(可选带 BOM,Windows 记事本打开不乱码),下方的常用实体速查表还能按名字、字符或码点搜索并逐条复制。
关于HTML 实体转换的常见问题
- HTML 实体转换会上传我粘贴的内容吗?
- 不会,HTML 实体转换不上传任何内容。所有转换都在你的浏览器里用 JavaScript 完成,粘贴的文本、上传的文件内容与转换结果都不会发送到任何服务器,关闭页面即清除。本页只把方向、预设、范围、写法、口径、单引号与 BOM 这类参数偏好写进本机 localStorage,原文与结果一个字都不落盘,也不会把文本同步到网址里。想自证很简单:打开 F12 的网络面板再转一次,计算过程零请求,断开网络照样出结果(页面本身会加载一个访问统计脚本,它不读取也不上报你粘贴的内容)。
- < > & 是什么意思?怎么还原成符号?
- 它们是 HTML 实体,也叫字符实体引用:一段以 & 开头、以分号结尾的写法,用来在网页源码里表示那些直接写会被解析器误会的字符。< 代表小于号,> 代表大于号,& 代表和号本身。之所以要这么写,是因为浏览器看到裸的小于号就会开始猜后面是不是标签名。要还原,把整段文本粘进本页、点「一键还原实体」即可,命名实体与 '、中 这类数值实体混在一起也能同时认出来,其余字符一个都不动。
- HTML 代码怎么原样显示在网页上?
- 把代码粘进本页,用默认的「代码贴进网页」预设转一遍,再把结果放进文章或 pre 标签里即可:小于号、大于号、和号与两种引号会变成实体,浏览器于是把它们当成普通文字画出来,而不是当成标签执行。要提醒一句:转义能让代码原样显示,但它不是安全过滤器,本页不判断哪个标签危险、也不会替你删掉 script,服务端仍然要做自己的校验与白名单。把转义说成防 XSS 神器是过度承诺。
- 网址里的 & 要不要转义成 &?
- 要转。HTML 属性里的和号是实体的开头字符,浏览器会先按实体规则去读它:<a href="p?a=1©=2"> 里的 © 命中 HTML5 那份可以省略分号的历史清单(106 条),被解析成版权号 ©,地址于是悄悄变成 p?a=1©=2,还不报任何错。参数名带 copy、reg、times、not 的链接最容易中招。正确写法是把和号转成 &,也就是 <a href="p?a=1&copy=2">,浏览器解析完拿到的仍是原来那个地址。把这段链接粘进本页用默认预设转一遍就是这个结果。要区分清楚的是:这与 URL 编码是两件事,把中文、空格转成 %E4%B8%AD 这种百分号编码请用 URL 编码解码,本页遇到 %XX 原样不动、也不报错。
- 是什么意思?怎么去掉?
- 是不换行空格,码点 U+00A0。 怎么去掉这件事要先说清楚:本页只帮你把它显形,不替你删。它长得和普通空格一模一样,却是另一个字符,所以在 Excel 里查找不到、在代码里匹配不上、导进数据库时对不上。它多半来自网页排版、Word 或 PDF 复制。本页的「只转不可见字符」范围会把它连同零宽空格、各种窄空格、BOM 一起转成实体让你看见它们在第几行第几列,但一个字符都不会替你删;真要清掉请用富文本清理。
- &lt; 这种双重转义怎么还原成 <?
- 这是数据被转义了两次的典型形状,成因通常是存库前转义了一次、渲染前又转义了一次。本页默认只解一层,所以 &lt; 解出来是字面的 < 而不是小于号,这是刻意的安全语义:一路解到底正是双重解码漏洞的形状。页面检测到这种模式时会在顶部弹出提示,并给「只解一层」与「解到底」两个一键切换。判断标准很简单:如果解一层之后你看到的还是实体写法,那就是被转了两次,再解一层即可,最多 8 轮。
- HTML 实体转换和去除 HTML 标签有什么区别?
- 目标正相反。去除 HTML 标签是把标签扔掉、只留正文文字,适合把网页内容变成纯文本;本页一个标签都不动,只是把字符换成它的实体写法,转义后的 b 标签还是完整的 b 标签,只不过变成了看得见的字。一句话:那边是不要标签,这边是标签要,但要变成看得见的字。两者可以串着用,先在那边去标签、再来这边转义,也可以反过来。
- 单引号该转成 ' 还是 '?
- 默认用 ' 最稳。' 是 XML 和 HTML5 才有的名字,HTML 4.01 的实体集里从来没有定义过它,IE8 之类的老环境会把 ' 原样显示成五个字符。而 ' 是数值字符引用,只要是能解析 HTML 的东西都认得。本页把它做成了一个开关,选 HTML 4.01 口径时这个开关会被口径否决并自动回落到数值写法,不会让你在不知情的情况下产出一段老浏览器读不懂的 HTML。
- XML 里为什么只能用 5 个 HTML 实体?
- XML 规范只预定义了 amp、lt、gt、quot、apos 这五个实体,其余名字都要靠 DTD 声明才存在。所以 写进一份裸 XML(比如 RSS、SVG 或配置文件)里,解析器会直接报未定义实体的错误,而不是显示成空格。本页的 XML 口径就是为这件事准备的:选上之后,除这五个之外的字符一律回落成数值实体, 会变成  ,任何 XML 解析器都能读。
- 汉字转 HTML 实体用 中 还是 中?
- 两种都对,指的是同一个汉字,区别只是十进制与十六进制两种写法。十六进制和 Unicode 码点表对得上,看起来更好核对;十进制在一些很老的系统里更保险。汉字没有命名实体,所以只能用这两种数值写法,本页的「非 ASCII 全转」范围加上写法下拉就能一键产出。顺带说清边界:如果你要的是源码里的 \u4e2d 或文档里的 U+4E2D,那是码点转义,请用 Unicode 转换,本页只管 & 开头分号结尾的这一族。
- € 是什么符号?为什么解出来是欧元?
- 因为 HTML5 规范对 € 到 Ÿ 这一段数值引用有一条特殊规定:不按码点解,而是按 Windows-1252 的对应字符解。€ 于是变成欧元符号而不是 U+0080 控制字符,’ 变成右单引号,— 变成长破折号。这正是从 Word 复制过来的文字里那些弯引号的来龙去脉。浏览器就是这么干的,本页默认跟随,但每一处都会在下面的列表里逐条告诉你,也可以在选项里关掉、改成如实按码点解。
- 手机上能做 HTML 实体编码解码吗?
- 可以。本页在手机浏览器里同样是本地计算,不依赖任何服务端接口,输入区与结果区会自动改成上下堆叠,下拉用系统原生控件,速查表降级成可横向滚动的表格,不会横着溢出屏幕。粘贴、复制、下载 txt 都能用。唯一要留意的是超长文本:手机内存有限,建议单次控制在几十万字以内,超过 20 万字页面会自动切换成点按钮加进度条、可随时取消的分片计算模式。
- HTML 实体转换有字数限制吗?能传文件吗?
- 完全免费、无需注册、不限次数。可以直接拖入 .html、.xml、.svg、.txt、.json、.md、.log 等纯文本文件,单文件上限 10 MB,超过会直接提示你拆分而不是硬扛。文本上限是 500 万字,超过 20 万字会自动切换成分片计算并显示进度、可随时取消;真的超过 500 万字上限会明确告诉你已处理到哪里,不会静默丢内容。结果超过 5000 行时文本框只渲染前 5000 行做预览,但复制和下载拿到的始终是完整数据。
- 转义后的 HTML 实体会执行 JS 吗?安全吗?
- 本页自身是安全的:它全程只做字符串扫描,不渲染 HTML、不建 DOM、不用 innerHTML,也不提供渲染预览,所以你粘进来的东西不可能在本页里执行。至于转义后的结果安不安全,要看你怎么用:把转义后的文本作为纯文本插进页面是安全的,但如果你的代码又把它当 HTML 拼回去、或者解码两次再输出,风险就回来了。本页只承诺如实转换,不承诺替你做 XSS 防护,服务端的校验与白名单不能省。
- 遇到不认识的 HTML 实体会被删掉吗?
- 不会,这是本工具的一条硬规矩。本页收录了 308 个常用命名实体,而 HTML5 规范里一共有 2231 条,剩下的绝大多数是数学排版专用、在真实网页里几乎不会出现。遇到表外的名字、越界码点、落在代理区的码点、缺分号或空的数值实体,一律原样保留,并在下面的列表里给出行号、列号、原文与原因。绝不会用替换字符糊过去,也绝不会猜一个字符给你——那会让你拿着一段悄悄坏掉的文本走。
HTML 实体 <、&、 分别是什么意思
先把最常被搜的两句说清楚:尖括号怎么在网页上显示——把它写成实体就行;< 怎么变成 <,靠的就是 「解码」这一步——把实体写法还原成字符本身。反过来把 < 写成 < 就是转义。两个细节最容易翻车:HTML 实体缺分号时浏览器有时能容错、 有时不能(<x 就不会被当成小于号),所以本页一律补齐分号; HTML 实体大小写敏感吗——命名实体是敏感的,© 与 © 在 HTML5 里不是一回事。单引号同理,' 怎么还原都没问题,但 ' 在老 IE 上会原样显示。
一句话:实体是写给解析器看的写法,不是给人看的字符。网页源码是纯文本, 浏览器靠小于号判断标签的开头、靠和号判断实体的开头。所以当你真的想显示一个小于号时, 就必须换一种写法告诉解析器「这是个普通字符,别当标签」——这就是 HTML 实体。它以 & 开头、以分号结尾,中间要么是一个名字,要么是一个数字。
| 实体 | 字符 | 十进制 | 十六进制 | 为什么要转 |
|---|---|---|---|---|
< | < | < | < | 小于号。裸写在网页里可能被当成标签开头 |
> | > | > | > | 大于号。与小于号成对转义最省心 |
& | & | & | & | 和号。它是所有实体的开头字符,所以必须最先转 |
" | " | " | " | 双引号。往属性值里塞用户输入时不转就能直接闭合属性 |
' | ' | ' | ' | 单引号。HTML 4.01 里没有这个名字,本页默认输出数值写法 |
这五个就是本页默认的「安全最小集」。真实需求几乎从来不是把每个字符都转一遍—— 把整段中文也转成 中 只会让源码没法读,还徒增体积。所以本页把 范围做成了一个独立开关,它比写法开关更影响可用性。
换个每天都在发生的算例:链接 <a href="p?a=1©=2">链接</a> 里的和号不转,© 会命中 HTML5 那份「可以省略分号」的历史清单被读成 ©,地址悄悄变成 p?a=1©=2 且不报任何错—— 参数名带 copy、reg、times、not 的链接最容易中招。用本页默认预设转一遍得到 <a href="p?a=1&copy=2">链接</a>,一共动了 7 个字符, 中文与路径一个字不动。
HTML 实体的三种写法:命名、十进制、十六进制
三种写法里,命名实体最好认,十进制实体与十六进制实体则是「按码点写」:同一个「中」字, 十进制实体是 中,十六进制实体是 中。 所以把 中 转中文得到的就是「中」;问 中 是什么,答案也是同一个字,只是进制不同。中文转 HTML 实体、HTML 实体转中文这两个方向本页各选一次「编码」「解码」即可, 三种写法都认。
同一个字符往往有三种合法写法,它们指的是同一个码点,区别只在出处与兼容性。© 是命名实体,好记但要求对方认得这个名字;© 与 © 是数值字符引用,直接写码点, 只要能解析 HTML 就一定认得。
| 字符 | 命名实体 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
| © | © | © | © | 有命名实体,三种写法等价 |
| 不换行空格 | |   |   | 看不见,但它不是普通空格,搜索与比对都对不上 |
| 中 | (无命名实体) | 中 | 中 | 汉字没有命名实体,只能用数值写法 |
| 😀 | (无命名实体) | 😀 | 😀 | emoji 是一个码点,输出也只有一段 |
注意「中」那一行:汉字没有命名实体,所以命名优先这一档遇到中文会自动 回落成数值写法。本页收录了 308 个常用命名实体,而 HTML5 规范里一共有 2231 条。剩下那 1900 多条绝大多数是数学排版专用(最长的一条叫 CounterClockwiseContourIntegral,31 个字母),在真实网页里的出现频次接近 0,把它们全塞 进首屏只会让每个访客都为几乎用不到的数据买单。处理方式是如实告知而不是猜:解码遇到表外名字会原样保留并点名,如果它其实是数值实体,本页一定认得。
&lt; 这种双重转义怎么还原
HTML 双重转义是指一段文本被转义了两次:< 先变成 <,其中的 & 又被转成 &, 于是屏幕上出现 &lt;。常见于三个场景——网页显示 < 怎么办、数据库里的 怎么处理, 以及转义后的 HTML 怎么还原回原样。&lt; 怎么还原? 解码一次得到 <,再解一次才是 <, 本页的「解码次数」就是干这个的。
从数据库或接口里捞出来的文本满屏 &nbsp;、页面上直接显示出 <div> 这几个字——这是同一个问题:数据被转义了两次。 常见成因是存库前框架转了一次、模板渲染前又转了一次,两次都没错,错的是叠在了一起。
| 原文 | 解一层的结果 | 解到底的结果 | 该选哪个 |
|---|---|---|---|
&lt; | < | < | 解一层后还是实体写法,说明被转了两次,再解一层 |
< | < | < | 只被转了一次,解一层就到位,不要再解 |
HTML5、HTML 4.01 与 XML 的实体口径差异
XML 转义字符只有五个:XML 五个预定义实体分别是 <、>、&、" 与 ',除此之外都要写成码点形式。HTML5 命名实体则有两千多个, 两边口径不同,选错档就会出现「在浏览器里好好的,喂给 XML 解析器就报错」。
同一个 在三种口径下的命运完全不同,这是别的在线实体工具基本 不提、却最容易让人踩坑的一条。
| 口径 | 允许的命名实体 | 为什么要有这一档 |
|---|---|---|
| HTML5(默认) | 表内全部命名实体 | 现代网页,什么都能用 |
| HTML 4.01 | 表内减去 HTML5 新增的名字(含 ') | ' 不在 HTML 4.01 实体集里,IE8 会把它原样显示成五个字符 |
| XML / RSS / SVG | 只有 & < > " ' 五个 | XML 只有 5 个预定义实体, 在裸 XML(无 DTD)里是未定义实体,解析器直接报错 |
最实际的两条结论:一,写 XML、RSS、SVG 或任何没有 DTD 的 XML 文档时, 会让解析器直接报未定义实体的错,必须写成  ;本页的 XML 口径就是替你把这件事一次做对,选上之后 除了那五个预定义实体,其余字符一律回落成数值写法。二,单引号在 HTML 4.01 里没有 ' 这个名字,所以本页默认输出 '; 勾了「单引号用 '」再切到 HTML 4.01 口径,开关会被口径否决并给出说明。
€ 为什么解出来是欧元符号
按码点算,€ 应该是 U+0080 这个控制字符。但 HTML5 规范专门规定:€ 到 Ÿ 这一段数值引用不按码点解,而是按 Windows-1252 重映射。 浏览器就是这么干的,本页默认跟随——不然你会得到一段和浏览器渲染结果不一致的文本,那比报错更危险。
| 数值实体 | 实际字符 | 真实码点 | 命名写法 |
|---|---|---|---|
€ | € | U+20AC | € |
… | … | U+2026 | … |
‘ | ‘ | U+2018 | ‘ |
’ | ’ | U+2019 | ’ |
“ | “ | U+201C | “ |
” | ” | U+201D | ” |
– | – | U+2013 | – |
— | — | U+2014 | — |
™ | ™ | U+2122 | ™ |
这段规则的历史来自 Windows 上的老编辑器:它们把 0x80 到 0x9F 这段本该是控制字符的区间 用来放欧元号、弯引号和破折号,于是网上大量老页面写着 ’ 却想显示右单引号。 规范为了兼容这些页面,把这条行为写了进来。本页把每一处重映射都当成提示级条目列出来, 让你知道工具做了什么;如果你要的是如实按码点解,把选项里的开关关掉即可。 顺带一提:0x81、0x8D、0x8F、0x90、0x9D 这五个位置在 Windows-1252 里没有定义,规范也没有 对应项,本页照码点解,不替它们编一个字符出来。
六档转义范围怎么选:HTML 实体不必全转
把用户输入安全地塞进 HTML 时,你要的是「中文和英文照样能读、只有那几个危险字符变成实体」, 而不是把每个字符都转一遍。范围开关就是干这个的。
| 范围 | 转什么 | 典型场景 |
|---|---|---|
| 安全最小集(默认) | 只转 & < > " ' 这 5 个字符 | 把用户输入或代码片段安全塞进 HTML,含属性值 |
| 只转尖括号与和号 | 只转 & < > 这 3 个字符,引号保持可读 | 只往文本节点里塞内容,不进属性值 |
| 所有有命名实体的字符 | 查表命中就转:© × — … ← α é 都会变成命名实体 | 老邮件模板、只认 ASCII 的 CMS、导出给旧系统 |
| 非 ASCII 全转 | U+0080 及以上一律转:中文、日韩文、emoji、全角标点 | 纯 ASCII 传输通道;中文按写法输出 中 或 中 |
| 只转不可见字符 | 零宽字符、NBSP、各种窄空格、BOM、控制字符、变体选择符 | 排查「肉眼一样却匹配不上」,与富文本清理的「删掉它们」互为镜像 |
| 全部字符 | 每个码点都转,英文字母与数字也不例外 | 逐字符检查、极端兼容场景 |
其中「只转不可见字符」是本页的第二个杀手锏:零宽空格、不换行空格、各种窄空格、BOM、 方向控制符、变体选择符会被转成实体现形出来,一眼就能看到多出来的是什么、 在第几行第几列,而中文和英文一个字都不会动。这正是「两段看起来一模一样的字符串就是不相等」 「Excel 里查找不到」的头号原因。本页只让它们现形、不替你删;要清掉请用富文本清理。 另外,制表符与换行刻意不算不可见字符——把换行也算进去会让整篇文本的换行全变成 ,真正要找的那个零宽空格反而被淹没。
下面这段是各档范围对同一个探针 <©中 的真实产出,直接由本页的转换实现算出来, 不是手抄的:
| 范围 | <©中 的产出 |
|---|---|
| 安全最小集(默认) | <©中 |
| 只转尖括号与和号 | <©中 |
| 所有有命名实体的字符 | <©中 |
| 非 ASCII 全转 | <©中 |
| 只转不可见字符 | <©中 |
| 全部字符 | <©中 |
常用 HTML 实体速查表:按名字、字符或码点查
查得最多的几个可以先在这里对一下:空格 HTML 代码是 (码点 160, 所以   是什么——就是它);版权符号 HTML 代码是 ©,问 © 是什么意思,答案是 ©;" 是什么意思——双引号 "。 其余特殊符号 HTML 代码都能在下表按名字、字符或码点查。
308 个常用命名实体按 9 类整理,每条都给出实体名、字符、十进制与十六进制四种写法, 可以按名字、字符或码点搜索,也能逐条或整组复制。表里的四种写法与本页的转换实现共用同一份数据、 同一个出口,所以你在这里看到的写法和你按下按钮拿到的结果永远一致。
共收录 308 个常用命名实体;四种写法都由本页的转换实现现算,与结果永远一致。
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
& | & | & | & | 和号。转义方向必须最先处理它,否则 < 会被二次转义成 &lt; |
< | < | < | < | 小于号。网页里出现裸 < 就可能被解析器当成标签开头 |
> | > | > | > | 大于号。与 < 成对转义,> 单独出现其实是安全的,但一起转更省心 |
" | " | " | " | 双引号。往 HTML 属性值里塞用户输入时必须转,否则能直接闭合属性 |
' | ' | ' | ' | HTML 4.01 里没有这个名字,IE8 会把它原样显示成五个字符;默认输出 ' |
& | & | & | & | |
< | < | < | < | |
> | > | > | > | |
" | " | " | " |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
| ␣ |   |   | 不换行空格 U+00A0。看着是空格,但搜索、Excel 查找、数据库导入统统对不上 |
  | ␣ |   |   | 半角空格,宽度约等于一个 n |
  | ␣ |   |   | 全角空格,宽度约等于一个 m |
  | ␣ |   |   | 三分之一 em 宽的空格 |
  | ␣ |   |   | 四分之一 em 宽的空格 |
  | ␣ |   |   | 数字空格,宽度与一个数字相同,用于表格数字对齐 |
  | ␣ |   |   | 标点空格,宽度与一个句点相同 |
  | ␣ |   |   | 窄空格,常用于数字与单位之间 |
  | ␣ |   |   | 发丝空格,比窄空格还窄 |
‌ | ␣ | ‌ | ‌ | 零宽不连字。完全看不见,却让两段「一模一样」的文字比对不相等 |
‍ | ␣ | ‍ | ‍ | 零宽连字。组合 emoji(👨👩👦)中间就有它 |
‎ | ␣ | ‎ | ‎ | 从左到右标记,方向控制符 |
‏ | ␣ | ‏ | ‏ | 从右到左标记,方向控制符 |
­ | ␣ | ­ | ­ | 软连字符。PDF、Word 为了行末断词插入,复制出来就成了单词里的隐形字符 |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
– | – | – | – | 短破折号,用于数字区间 1–9 |
— | — | — | — | 长破折号,中文里的「——」是两个它 |
― | ― | ― | ― | 水平横线,比长破折号更长 |
‘ | ‘ | ‘ | ‘ | 左单引号。Word 的「智能引号」会把直角引号自动换成它 |
’ | ’ | ’ | ’ | 右单引号。英文里的撇号 don’t 用的就是它,不是 ASCII 的 ' |
‚ | ‚ | ‚ | ‚ | 下单引号 |
“ | “ | “ | “ | 左双引号 |
” | ” | ” | ” | 右双引号 |
„ | „ | „ | „ | 下双引号,德文引号的下半 |
† | † | † | † | 剑号,脚注标记 |
‡ | ‡ | ‡ | ‡ | 双剑号,第二级脚注标记 |
• | • | • | • | 实心圆点,无序列表的项目符号 |
‥ | ‥ | ‥ | ‥ | 两点前导符 |
… | … | … | … | 省略号。中文的「……」是两个它 |
… | … | … | … | |
′ | ′ | ′ | ′ | 角分 / 英尺符号,不是 ASCII 的单引号 |
″ | ″ | ″ | ″ | 角秒 / 英寸符号,不是 ASCII 的双引号 |
‴ | ‴ | ‴ | ‴ | 三重撇号 |
‰ | ‰ | ‰ | ‰ | 千分号 |
‱ | ‱ | ‱ | ‱ | 万分号 |
‾ | ‾ | ‾ | ‾ | 上划线 |
⁄ | ⁄ | ⁄ | ⁄ | 分数斜线,写 1⁄2 这种分数用 |
⁃ | ⁃ | ⁃ | ⁃ | 连字符项目符号 |
‹ | ‹ | ‹ | ‹ | 单左尖括号引号 |
› | › | › | › | 单右尖括号引号 |
« | « | « | « | 左书名号,法俄文的引号 |
» | » | » | » | 右书名号 |
¡ | ¡ | ¡ | ¡ | 倒感叹号,西班牙语句首用 |
¿ | ¿ | ¿ | ¿ | 倒问号,西班牙语句首用 |
§ | § | § | § | 章节号 |
¶ | ¶ | ¶ | ¶ | 段落标记 |
· | · | · | · | 间隔号。中文人名里的「·」通常是 U+00B7 |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
¢ | ¢ | ¢ | ¢ | 美分 |
£ | £ | £ | £ | 英镑 |
¤ | ¤ | ¤ | ¤ | 通用货币符号,不是具体某种货币 |
¥ | ¥ | ¥ | ¥ | 日元 / 人民币符号 |
€ | € | € | € | 欧元。€ 解出来就是它,见正文 Windows-1252 一节 |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
− | − | − | − | 真正的减号,比 ASCII 连字符 - 更宽 |
× | × | × | × | 乘号,不是字母 x |
÷ | ÷ | ÷ | ÷ | 除号 |
± | ± | ± | ± | 正负号 |
¹ | ¹ | ¹ | ¹ | 上标 1 |
² | ² | ² | ² | 上标 2,写平方米 m² 用 |
³ | ³ | ³ | ³ | 上标 3,写立方米 m³ 用 |
¼ | ¼ | ¼ | ¼ | |
½ | ½ | ½ | ½ | |
¾ | ¾ | ¾ | ¾ | |
⅓ | ⅓ | ⅓ | ⅓ | |
⅔ | ⅔ | ⅔ | ⅔ | |
⅕ | ⅕ | ⅕ | ⅕ | |
⅛ | ⅛ | ⅛ | ⅛ | |
⅜ | ⅜ | ⅜ | ⅜ | |
⅝ | ⅝ | ⅝ | ⅝ | |
⅞ | ⅞ | ⅞ | ⅞ | |
ƒ | ƒ | ƒ | ƒ | 函数符号 ƒ。ƒ 按 Windows-1252 解出来就是它 |
∀ | ∀ | ∀ | ∀ | |
∂ | ∂ | ∂ | ∂ | 偏微分 |
∃ | ∃ | ∃ | ∃ | |
∅ | ∅ | ∅ | ∅ | 空集 |
∇ | ∇ | ∇ | ∇ | |
∈ | ∈ | ∈ | ∈ | 属于 |
∉ | ∉ | ∉ | ∉ | 不属于。¬in 在无分号容错下会被拆成 ¬ + in,见正文 |
∋ | ∋ | ∋ | ∋ | |
∏ | ∏ | ∏ | ∏ | 连乘 |
∐ | ∐ | ∐ | ∐ | |
∑ | ∑ | ∑ | ∑ | 求和 |
∗ | ∗ | ∗ | ∗ | |
√ | √ | √ | √ | 根号 |
∝ | ∝ | ∝ | ∝ | |
∞ | ∞ | ∞ | ∞ | 无穷 |
∠ | ∠ | ∠ | ∠ | 角 |
∧ | ∧ | ∧ | ∧ | |
∨ | ∨ | ∨ | ∨ | |
∩ | ∩ | ∩ | ∩ | 交集 |
∪ | ∪ | ∪ | ∪ | 并集 |
∫ | ∫ | ∫ | ∫ | 积分 |
∮ | ∮ | ∮ | ∮ | |
∴ | ∴ | ∴ | ∴ | 所以 |
∵ | ∵ | ∵ | ∵ | 因为 |
∣ | ∣ | ∣ | ∣ | |
∥ | ∥ | ∥ | ∥ | |
∼ | ∼ | ∼ | ∼ | |
≅ | ≅ | ≅ | ≅ | |
≈ | ≈ | ≈ | ≈ | 约等于 |
≠ | ≠ | ≠ | ≠ | 不等于 |
≡ | ≡ | ≡ | ≡ | 恒等于 |
≤ | ≤ | ≤ | ≤ | 小于等于 |
≥ | ≥ | ≥ | ≥ | 大于等于 |
⊂ | ⊂ | ⊂ | ⊂ | |
⊃ | ⊃ | ⊃ | ⊃ | |
⊄ | ⊄ | ⊄ | ⊄ | |
⊅ | ⊅ | ⊅ | ⊅ | |
⊆ | ⊆ | ⊆ | ⊆ | |
⊇ | ⊇ | ⊇ | ⊇ | |
⊕ | ⊕ | ⊕ | ⊕ | |
⊗ | ⊗ | ⊗ | ⊗ | |
⊥ | ⊥ | ⊥ | ⊥ | 垂直 |
⋅ | ⋅ | ⋅ | ⋅ | 点乘 |
⌈ | ⌈ | ⌈ | ⌈ | |
⌉ | ⌉ | ⌉ | ⌉ | |
⌊ | ⌊ | ⌊ | ⌊ | |
⌋ | ⌋ | ⌋ | ⌋ | |
◊ | ◊ | ◊ | ◊ | 菱形 |
℘ | ℘ | ℘ | ℘ | |
ℑ | ℑ | ℑ | ℑ | 虚部符号 |
ℜ | ℜ | ℜ | ℜ | 实部符号 |
ℵ | ℵ | ℵ | ℵ |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
← | ← | ← | ← | |
↑ | ↑ | ↑ | ↑ | |
→ | → | → | → | 右箭头,写「A → B」用 |
↓ | ↓ | ↓ | ↓ | |
↔ | ↔ | ↔ | ↔ | |
↕ | ↕ | ↕ | ↕ | |
↖ | ↖ | ↖ | ↖ | |
↗ | ↗ | ↗ | ↗ | |
↘ | ↘ | ↘ | ↘ | |
↙ | ↙ | ↙ | ↙ | |
↵ | ↵ | ↵ | ↵ | 回车箭头 |
⇐ | ⇐ | ⇐ | ⇐ | 注意大小写:lArr 是双线箭头,larr 是单线 |
⇑ | ⇑ | ⇑ | ⇑ | |
⇒ | ⇒ | ⇒ | ⇒ | |
⇓ | ⇓ | ⇓ | ⇓ | |
⇔ | ⇔ | ⇔ | ⇔ | |
⇕ | ⇕ | ⇕ | ⇕ |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
α | α | α | α | |
β | β | β | β | |
γ | γ | γ | γ | |
δ | δ | δ | δ | |
ε | ε | ε | ε | |
ζ | ζ | ζ | ζ | |
η | η | η | η | |
θ | θ | θ | θ | |
ι | ι | ι | ι | |
κ | κ | κ | κ | |
λ | λ | λ | λ | |
μ | μ | μ | μ | 希腊字母 μ(U+03BC),与「微」符号 µ(U+00B5, µ)是两个不同的字符 |
ν | ν | ν | ν | |
ξ | ξ | ξ | ξ | |
ο | ο | ο | ο | |
π | π | π | π | |
ρ | ρ | ρ | ρ | |
ς | ς | ς | ς | 词尾用的 sigma |
σ | σ | σ | σ | |
τ | τ | τ | τ | |
υ | υ | υ | υ | |
φ | φ | φ | φ | |
χ | χ | χ | χ | |
ψ | ψ | ψ | ψ | |
ω | ω | ω | ω | |
Α | Α | Α | Α | |
Β | Β | Β | Β | |
Γ | Γ | Γ | Γ | |
Δ | Δ | Δ | Δ | |
Ε | Ε | Ε | Ε | |
Ζ | Ζ | Ζ | Ζ | |
Η | Η | Η | Η | |
Θ | Θ | Θ | Θ | |
Ι | Ι | Ι | Ι | |
Κ | Κ | Κ | Κ | |
Λ | Λ | Λ | Λ | |
Μ | Μ | Μ | Μ | |
Ν | Ν | Ν | Ν | |
Ξ | Ξ | Ξ | Ξ | |
Ο | Ο | Ο | Ο | |
Π | Π | Π | Π | |
Ρ | Ρ | Ρ | Ρ | |
Σ | Σ | Σ | Σ | |
Τ | Τ | Τ | Τ | |
Υ | Υ | Υ | Υ | |
Φ | Φ | Φ | Φ | |
Χ | Χ | Χ | Χ | |
Ψ | Ψ | Ψ | Ψ | |
Ω | Ω | Ω | Ω | |
ϑ | ϑ | ϑ | ϑ | |
ϒ | ϒ | ϒ | ϒ | |
ϖ | ϖ | ϖ | ϖ |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
À | À | À | À | |
Á | Á | Á | Á | |
 |  |  |  | |
à | à | à | à | |
Ä | Ä | Ä | Ä | |
Å | Å | Å | Å | |
Æ | Æ | Æ | Æ | |
Ç | Ç | Ç | Ç | |
È | È | È | È | |
É | É | É | É | |
Ê | Ê | Ê | Ê | |
Ë | Ë | Ë | Ë | |
Ì | Ì | Ì | Ì | |
Í | Í | Í | Í | |
Î | Î | Î | Î | |
Ï | Ï | Ï | Ï | |
Ð | Ð | Ð | Ð | |
Ñ | Ñ | Ñ | Ñ | |
Ò | Ò | Ò | Ò | |
Ó | Ó | Ó | Ó | |
Ô | Ô | Ô | Ô | |
Õ | Õ | Õ | Õ | |
Ö | Ö | Ö | Ö | |
Ø | Ø | Ø | Ø | |
Ù | Ù | Ù | Ù | |
Ú | Ú | Ú | Ú | |
Û | Û | Û | Û | |
Ü | Ü | Ü | Ü | |
Ý | Ý | Ý | Ý | |
Þ | Þ | Þ | Þ | |
ß | ß | ß | ß | 德语 ß |
à | à | à | à | |
á | á | á | á | |
â | â | â | â | |
ã | ã | ã | ã | |
ä | ä | ä | ä | |
å | å | å | å | |
æ | æ | æ | æ | |
ç | ç | ç | ç | |
è | è | è | è | |
é | é | é | é | é 是一个码点 U+00E9;e + 组合重音符是两个码点,本页如实按两种结果输出 |
ê | ê | ê | ê | |
ë | ë | ë | ë | |
ì | ì | ì | ì | |
í | í | í | í | |
î | î | î | î | |
ï | ï | ï | ï | |
ð | ð | ð | ð | |
ñ | ñ | ñ | ñ | |
ò | ò | ò | ò | |
ó | ó | ó | ó | |
ô | ô | ô | ô | |
õ | õ | õ | õ | |
ö | ö | ö | ö | |
ø | ø | ø | ø | |
ù | ù | ù | ù | |
ú | ú | ú | ú | |
û | û | û | û | |
ü | ü | ü | ü | |
ý | ý | ý | ý | |
þ | þ | þ | þ | |
ÿ | ÿ | ÿ | ÿ | |
Œ | Œ | Œ | Œ | |
œ | œ | œ | œ | |
Š | Š | Š | Š | |
š | š | š | š | |
Ÿ | Ÿ | Ÿ | Ÿ | |
Ž | Ž | Ž | Ž | |
ž | ž | ž | ž |
| 实体 | 字符 | 十进制 | 十六进制 | 说明 |
|---|---|---|---|---|
© | © | © | © | 版权符号 |
© | © | © | © | |
® | ® | ® | ® | 注册商标符号 |
® | ® | ® | ® | |
™ | ™ | ™ | ™ | 商标符号 |
° | ° | ° | ° | 度数符号,写 25°C 用 |
µ | µ | µ | µ | 微符号 µ(U+00B5),与希腊字母 μ(U+03BC, μ)是两个不同的字符 |
¦ | ¦ | ¦ | ¦ | |
¨ | ¨ | ¨ | ¨ | |
ª | ª | ª | ª | |
º | º | º | º | |
¬ | ¬ | ¬ | ¬ | 否定号。它在无分号历史清单里,所以 ¬in 会被拆成 ¬ + in |
¯ | ¯ | ¯ | ¯ | |
´ | ´ | ´ | ´ | |
¸ | ¸ | ¸ | ¸ | |
ˆ | ˆ | ˆ | ˆ | 抑扬符。ˆ 按 Windows-1252 解出来就是它 |
˜ | ˜ | ˜ | ˜ | 波浪符。˜ 按 Windows-1252 解出来就是它 |
♠ | ♠ | ♠ | ♠ | |
♣ | ♣ | ♣ | ♣ | |
♥ | ♥ | ♥ | ♥ | |
♦ | ♦ | ♦ | ♦ | |
♪ | ♪ | ♪ | ♪ | 八分音符 |
♭ | ♭ | ♭ | ♭ | |
♮ | ♮ | ♮ | ♮ | |
♯ | ♯ | ♯ | ♯ | |
★ | ★ | ★ | ★ | 实心五角星 |
☆ | ☆ | ☆ | ☆ | 空心五角星 |
☎ | ☎ | ☎ | ☎ | |
♀ | ♀ | ♀ | ♀ | |
♂ | ♂ | ♂ | ♂ | |
✓ | ✓ | ✓ | ✓ | 对勾 |
✗ | ✗ | ✗ | ✗ | 叉 |
␣ | ␣ | ␣ | ␣ | 可见的空格符号 ␣,本身是个正常字符,不是不可见字符 |
□ | □ | □ | □ | |
▪ | ▪ | ▪ | ▪ | |
▭ | ▭ | ▭ | ▭ | |
▴ | ▴ | ▴ | ▴ | |
▸ | ▸ | ▸ | ▸ | |
▾ | ▾ | ▾ | ▾ | |
◂ | ◂ | ◂ | ◂ |
HTML 实体转换能做什么、不做什么
| 事项 | 本页的处理 |
|---|---|
| 转义方向 | 6 档范围 × 3 种写法 × 3 种口径,单引号写法与十六进制大小写可单独选 |
| 还原方向 | 命名实体与十进制、十六进制数值实体混排一次认全,默认只解一层 |
| 命名实体收录 | 308 个常用项;规范里共 2231 条,表外的原样保留并点名,绝不猜 |
| 大小写 | 命名实体大小写敏感,&Amp; 不等于 &,认不出就原样保留 |
| 缺分号 | 默认原样保留;打开历史清单容错后按 HTML5 的 106 条清单最长匹配 |
| Windows-1252 | 默认按规范重映射 €–Ÿ 并逐条提示,可关闭改成按码点解 |
| 去 HTML 标签 | 不做。本页一个标签都不动,去标签请用「去除 HTML 标签」 |
| 美化 / 压缩 HTML | 不做,请用「HTML 格式化」;本页不改任何空白与换行 |
| HTML 净化 sanitize | 不做。转义不等于安全过滤,本页不判断哪个标签危险,服务端仍要校验 |
| 渲染预览 | 不做。本页不建 DOM、不用 innerHTML,粘进来的东西不可能在本页执行 |
| 码点转义 | 不做 \u4e2d、U+4E2D、%u4E2D,请用「Unicode 转换」 |
| URL 百分号编码 | 不做 %E4%B8%AD,请用「URL 编码解码」;遇到它本页原样不动也不报错 |
| NFC / NFD / NFKC 归一 | 不做。é 与 e 加组合重音符是两串不同码点,本页如实按两种结果输出 |
| 八进制与裸数字 | 不做。20013 到底是码点还是数字无法判断,一律不动 |
| 单次上限 | 500 万字或 10 MB;超过 20 万字自动分片并显示进度、可取消 |
| 网络请求与落盘 | 零请求;只把方向、范围、写法等参数偏好记在本机,原文与结果不落盘 |
这件事在中文里叫法很杂:HTML 转义与 HTML 反转义、HTML 实体解码、HTML 转义字符、 HTML 字符实体、HTML 特殊字符转义,按场景又叫在线 HTML 转义工具、HTML 转义在线、 HTML 实体转换器、HTML 实体在线转换、HTML 实体转换在线——说的都是同一件事: 在字符与实体之间来回换。要按符号反查名字,本页下方的 HTML 实体对照表支持按名字、 字符或码点三种查法。
英文语境下这类工具通常叫 html entity encoder、html escape online、html unescape online 或 html unescape, 搜 encode html entities、html entity decoder 找到的都是同一件事。要按名字找一个符号 (比如「℃ 怎么打」)请用「特殊符号大全」;要把整段 HTML 变成纯文本请用「去除 HTML 标签」; 要把粘贴过来的富文本连同零宽字符一起清干净请用「富文本清理」。