文本去水印
⚡ 本地运行🔒 不上传数据🆓 免登录免费
你有没有遇到过这种情况:从网页复制一段文字,粘贴到搜索框里却搜不到任何结果;或者一段看起来完全正常的文本,粘贴进代码编辑器就报错,肉眼却看不出任何异常。罪魁祸首往往是不可见字符——Unicode 里有一批没有字形、宽度为零的字符,比如零宽空格(U+200B)、字节顺序标记(U+FEFF)、软连字符(U+00AD)。它们在屏幕上完全隐形,却实实在在占据着字符位置,参与字符串的比较、计数和解析。
这些字符有两个主要来源。一是无意带入:从网页、PDF、Word 文档复制文本时,排版用的软连字符、双向文本控制符会被一并复制;Windows 记事本保存的 UTF-8 文件会在开头加上 BOM,粘贴进代码就成了非法字符。二是人为植入:很多内容平台会在用户复制文本时悄悄插入零宽字符作为“水印”,用零宽字符的排列组合给每次复制打上唯一标记,用来追踪内容被搬运到了哪里。你的文章被洗稿,原作者可能就是靠这些隐形水印找到你的。
典型使用场景有三个。第一,清理复制来的文本:写论文、做运营、整理资料时从网页复制大段文字,先过一遍去水印,避免隐形字符污染你的文档,也避免你无意中把别人的追踪水印带进自己的内容。第二,排查诡异 bug:JSON 解析失败、密码“明明对了却登录不上”、CSV 导入错位,先把可疑文本贴进来检测,八成是某个不可见字符在作怪。第三,内容合规自查:发稿前检查一遍,确认没有平台植入的追踪水印,保护自己的内容不被溯源。
有几个边界情况需要注意。零宽连字(U+200D)并不是只有坏用途:在阿拉伯语、印地语等文字的排版里它是必需的连字控制符,更重要的是,emoji 里的家庭、职业组合表情(如 👨👩👧)就是靠零宽连字把多个人形符号连成一个表情的——清理掉它,组合表情会碎成几个独立小人。工具默认全选所有类型,但你可以按类别单独勾选,清理 emoji 文本时记得把“零宽连字”这一项去掉。另外,BOM(U+FEFF)出现在文件开头时是合法的编码标记,只有出现在文本中间时才是异常;软连字符在德语等语言的断行排版里是合法字符。工具只做机械的查找与删除,不判断语义,清理重要文本前建议先备份原文。
所有检测和清理都在你的浏览器本地完成,文本不会上传到任何服务器。你可以放心粘贴包含敏感信息的内容。检测报告会实时列出每类不可见字符的数量和码点,清理后也会显示共移除了多少个字符,整个过程透明可验证。
使用方法
- 在输入框粘贴或输入要检查的文本,检测报告会实时显示各类不可见字符的数量。
- 在“选择要清理的类型”中勾选要删除的字符类别(默认全选;含 emoji 的文本建议取消勾选“零宽连字”)。
- 点击“一键清理”,清理后的文本会显示在下方文本框,可直接复制使用。
常见问题
清理会误删正常文字吗?
不会。工具只删除 8 类明确的不可见格式字符(零宽空格、零宽连字/非连字、BOM、软连字符、单词连接符、双向控制符等),所有可见字符、空格、换行、标点都原样保留。唯一的例外是 emoji 组合序列依赖零宽连字,清理前请按类别取消勾选。
为什么从网页复制的文本搜索不到、比对不上?
很可能是复制时带入了零宽空格或平台植入的隐形水印。这些字符肉眼不可见,但搜索引擎和字符串比对会把它们当作真实字符,导致“看起来一样,机器认为不一样”。用本工具检测清理后再搜索比对即可。
什么是零宽字符水印?
一种隐形追踪技术:用零宽空格、零宽连字等字符的不同排列组合对文本进行编码标记,肉眼完全看不见,但程序可以读出。内容平台用它追踪文章被复制搬运的去向。把文本贴进本工具,检测报告里出现大量零宽字符,就说明文本带水印。
BOM 是什么?为什么它会导致报错?
BOM(字节顺序标记,U+FEFF)是 Unicode 文件开头的编码标记,本身合法。但当它出现在文本中间(比如从记事本复制内容粘贴进代码或 JSON),解析器会把它当成非法字符,导致 JSON 解析失败、脚本报错。清理时勾选“字节顺序标记”即可去除。
清理后的文本还能恢复吗?
删除是不可逆的,被移除的不可见字符无法从清理结果中找回。建议清理前先复制保留原文,或使用浏览器的撤销功能。工具本身不保存你的任何输入,刷新页面后内容即消失。