零宽字符检测

检测文本中肉眼不可见的零宽空格、连接符与 BOM,按类型统计并精确定位。支持一键清理和插入测试,适合排查字符串比较、搜索、代码与数据清洗异常。

请求即处理,不持久化文本
输入文本
0 / 100,000
支持 U+200B、U+200C、U+200D、U+2060、U+FEFF Ctrl + Enter 快速检测
插入零宽字符用于测试
检测结果
等待检测
0字符总数
0零宽字符
0可见码元
0发现类型
可视化结果 粉色标记代表不可见字符
检测后,不可见字符会以带编码的标记显示在原始位置。
匹配位置 最多展示前 200 项
位置 字符 行 / 列 上下文
暂无匹配记录

支持检测的字符

U+200B · ZWS零宽空格用于无可见间距的换行机会
U+200C · ZWNJ零宽非连接符阻止相邻字符发生连写
U+200D · ZWJ零宽连接符控制连字及部分 Emoji 组合
U+2060 · WJ单词连接符阻止相邻内容在此处换行
U+FEFF · ZWNBSP零宽不换行空格 / BOM文本中间出现时通常需要排查

功能特性

精确定位

返回字符索引、行号和列号,并保留上下文,快速找到肉眼无法识别的位置。

可视化高亮

将不可见字符替换为 ZWS、ZWJ 等可读标记,原始文本结构保持清晰。

一键清理

移除已支持的零宽字符并复制干净文本,适合数据入库和代码提交前检查。

稳健处理

服务端限制输入长度并校验处理模式;插入时按 Unicode 标量遍历,保护 Emoji 字符。

使用方法

粘贴文本

从网页、文档、代码编辑器或数据库中复制内容,粘贴到输入区域。

执行检测

点击检测按钮,查看零宽字符总数、类型、可视化标记及具体位置。

清理或复制

确认结果后清理输入文本,或直接复制后端生成的干净文本继续使用。

常见问题

零宽字符是什么,为什么肉眼看不到?
零宽字符属于 Unicode 格式控制字符,本身不占可见宽度,但会参与字符串长度计算并影响排版、连写或换行。例如,U+200B 是零宽空格,通常用于提供隐藏的换行机会。
零宽字符会导致哪些常见问题?
两个看起来完全相同的字符串可能因为隐藏字符而比较不相等,进而造成搜索失败、用户名重复、数据库去重失效或代码语法异常。复制自 PDF、富文本网页和聊天软件的内容尤其值得检查。
可以直接删除所有零宽字符吗?
需要结合文本语种和用途判断。U+200CU+200D 在波斯语、阿拉伯语、印度文字和 Emoji 组合中可能具有实际语义。处理自然语言内容前建议先查看位置,再决定是否清理。
U+FEFF 和文件 BOM 有什么关系?
U+FEFF 位于文件开头时可作为字节顺序标记 BOM;出现在字符串中间时则表现为零宽不换行空格,通常来自错误拼接、编码转换或复制操作。
输入文本会被保存吗?
不会。页面会通过 POST 请求完成检测和转换,但控制器仅在当前请求内处理文本,不写入数据库、日志文件或缓存。单次输入最多 100,000 个 UTF-16 码元。