EN← 返回主页

Unicode

Unicode 字符检查器

逐字符展示码点与编码,高亮零宽字符、控制字符等「看不见的坑」;排查"看起来一样但比对不过"的文本问题。

输入

关于零宽字符检测

两段文本"看起来一模一样"却比对不过?多半是藏了零宽空格、BOM、不间断空格、全角空格这类不可见字符——从网页、Word、聊天工具复制文本时很容易带入。本工具逐字符展示码点(U+XXXX)、UTF-8/UTF-16 编码和字符类别,自动高亮所有不可见字符并支持一键清除(保留正常的换行和制表符),也能识别西里尔同形字母这类"钓鱼字符"。

常见问题

零宽字符是从哪来的?

常见来源:网页复制(有些站点故意嵌入零宽字符做防复制水印)、Word/富文本编辑器、Windows 记事本保存的 UTF-8 BOM 文件头,以及聊天软件的格式转换。

零宽字符会造成什么问题?

典型症状:字符串比对失败、数据库查不到"明明存在"的记录、JSON/代码解析报错、用户名重复注册检测被绕过。因为肉眼不可见,不借助工具很难定位。

UTF-8 和 UTF-16 有什么区别?

都是 Unicode 的编码方式:UTF-8 变长(英文 1 字节、中文 3 字节),是网络传输和文件的事实标准;UTF-16 以 2 字节为单位,是 JavaScript/Java 字符串的内存表示。同一字符两种编码的字节序列不同,本工具都会展示。