UTILS.
100% 浏览器内运行
🔤

Unicode 码点转换器

检查文本并将每个字符转换为其 Unicode 码点、UTF-8/UTF-16 字节、HTML 实体和转义——或从码点重建文本。

在上方输入文本或码点。

关于此工具

Unicode 码点转换器逐字符分解文本并显示每个字符的每种常见表示,同时也能反向工作,从你粘贴的码点重建字符串。在正向模式下,它按码点(而非按 UTF-16 单元)迭代,因此由代理对组成的星际字符和 emoji 被正确地作为单个字符处理。

对每个字符,它报告 U+ 十六进制码点、十进制码点、十六进制的 UTF-8 字节序列(通过浏览器的 TextEncoder)、十六进制的 UTF-16 码元、数字 HTML 实体(&#nnnn;),以及 JavaScript/JSON 转义(\uXXXX,或对 U+FFFF 以上的码点使用 \u{...})。这非常适合调试编码问题、发现不可见或形近字符,或为源代码构建转义序列。

在反向模式下,你可以几乎任何记法粘贴码点——U+1F600、纯十进制、\uXXXX、\u{1F600}、😀、😀 或 0x 前缀的十六进制,以空格或逗号分隔——工具会验证每一个(拒绝 U+10FFFF 以上的值和孤立代理),并用 String.fromCodePoint 重建字符串。所有处理都在你的浏览器本地进行,因此私密文本绝不离开页面。

常见问题

它能处理 emoji 和星际字符吗?
能。正向模式按 Unicode 码点迭代,因此像 😀(U+1F600)这样以 UTF-16 代理对存储的 emoji 被视为一个字符,其转义输出为 \u{1F600}。
反向模式接受哪些格式?
U+XXXX 十六进制、纯十进制、\uXXXX 和 \u{XXXXX} JavaScript 转义、HTML 实体 &#nnnn; 和 &#xHHHH;,以及 0x 前缀的十六进制。用空格或逗号分隔多个码点,字符串会按顺序重建。
UTF-8 和 UTF-16 列有什么区别?
UTF-8 显示以 UTF-8 编码存储该字符所用的 1–4 个字节,而 UTF-16 显示 16 位码元(一个,或代理对时两个)。同一字符的两者都以十六进制给出。
无效输入会被拒绝吗?
会。反向模式会标记任何不是有效 Unicode 标量值的内容——U+10FFFF 以上的码点或代理范围 U+D800–U+DFFF 中的码点——因此你绝不会构建出格式错误的字符串。

更多工具