技术突破

Claude水印一夜变废纸:开源移除工具斩获11k Star,三层扒皮法攻破SynthID

2026年8月17日,开源水印移除工具watermarks-remover在GitHub上爆火狂揽11000颗星。项目采用MIT开源协议,不仅能抹除Claude的水印,还让Google的SynthID-Text和OpenAI的隐形标记也难逃一劫,连图像和PDF文件中的C2PA鉴权数据、EXIF元数据也能清得干干净净。就在上周Anthropic还高调发博客详解引以为傲的文本水印追踪技术,没想到几天后回旋镖就打到自己头上。

工具采用"三层扒皮法"。Layer A进行深度文本卫生清理——清理常规隐形Unicode字符连特殊空白符、双向文本控制字符等一切可能携带Payload的隐藏字符,完全无损。Layer B针对SynthID-Text的终极必杀——"代理重写洗稿":引入非源头模型(如本地Ollama运行Llama 3或调用其他API),用特定Prompt在保持原意和专业术语情况下对文本进行大面积释义和回译。既然Claude用圆周率走位,Layer B就直接掀翻棋盘用Llama 3的概率分布重新走一遍,彻底破坏原文本统计学特征。Layer C精准定位文件中C2PA、EXIF、XMP乃至DOCX/PDF的文档属性并直接剥离。

项目还集成图像像素级洗刷——对SynthID-media、StegaStamp、Tree-Ring等把信号打进像素频域的图像水印,使用CtrlRegen引擎(结合ControlNet和DINOv2 IP-Adapter)受控重新生成高度相似的图,大于512x512自动重叠分块处理后平滑拼接。并引入清华大学主导的MarkLLM框架做科学靶向验证——先用KGW机制打水印再用Layer B清洗最后用MarkLLM检测,检测器报"未发现水印"才证明清洗闭环。有趣的是网友让Claude自己运行插件清除标记被直接拒绝——Anthropic底层协议写死了限制禁止自家AI协助移除监管标记,但把插件装到中国大模型身上秒装成功。这场猫鼠游戏远未结束,但开源社区用代码捍卫了控制权。

← 返回AI热点列表