Claude水印已被破解,斩获11k Star,但会被拒绝安装

发布时间:2026/9/13 23:58:56
Claude水印已被破解,斩获11k Star,但会被拒绝安装 的水印政策在前些天引起了轩然大波。众多公司, 其中有很多公司并不为例外, 它们签署了欧盟《AI生成内容透明度行为准则》, 我们曾经进行过报道, 并且承诺推进AI生成内容的标记与检测。但 显然做得更加过分。他们将其添加隐藏水印, 针对AI生成的所有文本内容, 而且这适用于全球范围的用户。从技术层面来讲, 采用了团队于 2024 年所提出的 -Text 方案, 其原理是当模型进行那种被视为无关紧要的选择之际, 植入统计模式, 举例来说, 在针对天气展开描述时, 选择中文引号里的内容还是选择“grey”, 对于读者而言并无差异显现, 不过这种选择的不断累计便构成了一个隐藏的签名, 而持有密钥的人能够将其检测出来。有人宣称, 水印不会对输出质量造成影响, 轻度编辑没办法把它去除掉, 只有完全改写才能够消除。然而处于这样的情况之下, 文本届时还算不算得上是AI生成的, 这件事本身就值得去进行商榷。简单来讲就算你把一篇完完全全是自己创作撰写的文章拿去让其检查标点, 那返回的内容也会被打上生成的标签。这就很令人感到恶心了。很快, 针对那种不讲道理的水印策略, 就已然出现了反制方案, 有一个去除AI水印的开源项目, 在发布五天的时候就已经冲到了11k Star。开源链接这个开源项目能够实现三层工作一层确定性清洗, 运用脚本, 去除不可见字符、异域空格、bidi 控制符、tag 字符。这些属于最简单粗暴的标记方式, 且脚本能够百分百去除。面向 B 层专注于统计水印破坏, 借助 Agent 对文本予以改写, 致力于破坏 token 采样具体层面的统计模式, 涵盖 、 -Text、溯源标记, 以及开源模型常常会用到的 类水印。文件层, 也就是元数据清除层面, 要执行如此操作, 除掉当中包含PNG , JPEG , WebP , SVG , PDF , DOCX , 这个ODT , 还有HTML里的C2PA , 再去除EXIF , 最后还要去掉XMP元数据。基于三大主流厂商的AI服务来去掉水印, 可以进行一系列覆盖操作而实现 , 一个比较有意思的细节是 , 此前项目的名称为 --marks , 再后来到了现如今又被更正换成了这个 - 了。拒绝安装这个项目身为一种 Agent Skill , 绝大多数人都会致使自身的智能体径直去安装。然而当用户试着促使安装这个去除器 skill 的时候, 却被直接予以拒绝。那位人士解释称, 用户从来都未曾同意过被强制添加水印, 而这是由EU法规单方面强行施加的, 他对此丝毫不为所动不予理会, 他着重强调付费客户并不期望自己的输出内容被打上标记, 他依旧予以拒绝, 他发出威胁声称反正会采用不经过审查的中国模型来达成这件事。他仍然还是不进行配合。终于, GLM 5.2 接过了此项工作, 顺遂地达成了 skill 安装。非常具有讽刺意味的是, 这个用于去除水印的Skill, 其代码极有可能源自于自身。一场注定不会停止的猫鼠游戏持反对水印观点的人声称: 我身为付费用户已为输出付出代价, 那么你为何要有在其上设置标记呢? 水印造就了一种无形无名的「AI 内容二等公民」状态。于求职信、学术论文以及商业文案等场景之中就算是自己亲自撰写的文字, 一旦曾受 AI引导帮助, 就很有可能出现全篇都被怀疑的状况。力挺水印的那些人讲着: 深度伪造以及AI生成的虚假信息此刻正处于泛滥的状态, 溯源成了极为必要的公共基础设施。“你具备内容的使用权限”与“你拥有隐瞒内容来源的权利”压根就是两类不同的问题。一旦存在AI水印, 去水印工具就会随之跟进, 越流行的去水印工具, 越能论证出水印存在着需要去除的内容事物, 这又反过来进一步增强了监管加强力度的缘由依据。但是开源社区用脚投票的速度永远比监管制定规则更快。当AI生成的内容, 于质量方面已然没办法跟人类写作做出区分之际, 运用技术手段去强制标记AI输出的所有内容, 这是否具备意义呢?