Unicode 字符表
41 个常用 Unicode 区段的字符表,支持字符、U+4E2D、十六进制与十进制码点搜索,每个字符都能看到 UTF-8 字节、UTF-16 码元、HTML 实体、JS 转义与通用类别。
浏览器本地运行所有计算都在你的浏览器里完成,数据不会离开本机。
码点范围 U+0000–U+007F · 共 128 个码点 · 显示 128
点一个字符即可复制它,并在这里查看它的全部编码信息。
这个工具能做什么
- 查一个字符到底是什么:输入中、←、🎉 或 U+4E2D,立刻拿到码点、UTF-8 字节、UTF-16 码元和各种转义写法。
- 排查乱码与宽度问题:看清字符落在哪个区段、属于哪个通用类别,是不是控制字符或空白字符。
- 写 HTML 或 JS 时找正确的写法:十进制 / 十六进制 HTML 实体、\uXXXX 或 \u{XXXXX} 转义一键复制。
- 按区段浏览符号:箭头、制表符、数学运算符、表情符号等 41 个常用区段,随手挑一个复制走。
示例
输入
U+4E2D
输出
字符:中 码点:U+4E2D 十进制:20013 UTF-8 字节:E4 B8 AD UTF-16 码元:4E2D HTML 实体(十进制):中 HTML 实体(十六进制):中 JS 转义:\u4E2D 通用类别:Lo 可打印:是 控制字符:否 空白字符:否
搜索框里输入「中」「U+4E2D」「4e2d」「20013」或「中」都能定位到同一个码点。通用类别 Lo 表示「其它字母」(不含大小写的汉字、日文假名等)。
常见问题
Emoji 为什么有 4 个 UTF-8 字节、2 个 UTF-16 码元?
U+FFFF 以上的字符在 UTF-8 里需要 4 字节;JavaScript 字符串用的是 UTF-16,超出基本多文种平面的字符必须用一对代理项表示,所以 🎉(U+1F389)的 UTF-16 是 D83C DF89 两个码元。这也是 str.length 数 emoji 会多 1 的原因。
通用类别里的 Lu、Ll、Lo、So 都是什么意思?
这是 Unicode 的通用类别缩写:Lu 大写字母、Ll 小写字母、Lo 其它字母(汉字、假名)、Nd 十进制数字、Po 其它标点、So 其它符号(含大部分 emoji)、Cc 控制字符。工具用内置正则判断,不依赖任何外部数据表。
为什么表里只显示前 256 个字符?
中日韩统一表意文字有两万多个码点,一次全部渲染会明显卡顿。区段默认最多列出 256 个字符,而「杂项符号与图形」这类稀疏区段按步长采样;要看某个具体字符,直接在搜索框里输入它更准。
输入的码点找不到结果怎么办?
搜索只在内置的 41 个常用区段里查找,落在这些区段之外的码点(例如某些小众文字或私用区)会提示「没有匹配的码点」。此时可以改用 UTF-8 编码分析工具直接看字符的字节。
点击字符会做什么?会联网吗?
点击字符会把它复制到剪贴板,并在下方展示它的全部编码信息。所有数据都是本地用 String.fromCodePoint 生成的,页面不发任何网络请求。
关键词:unicodecode point码点字符表utf-8utf-16html entityunicode table字符编码