首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

程序员表示他们已经找到了克劳德隐形水印的解决方法

2026-08-20 1 阅读 约5分钟阅读 Isabella Ward
分享:
字号:
在 Anthropic 确认 Claude 模型将在全球范围内将不可见的机器可读水印嵌入到任何人工智能生成的内容中的四个小时内,开发人员 Guillaume Meyer 发布了他的替代方案。他从 Claude 生成的文本中删除水印的代码在 GitHub 上疯传,在 X 上被添加书签超过 20,000 次,并吸引了 100 多名贡献者,其中更多人将该技术融入到自己的项目中。一位人工智能专家写道:“Anthropic 在其 Claude 文本中嵌入了水印……仅仅一天后,这个问题实际上就成为历史了。”同时还附上了一张迈耶挣脱锁链、站在皱巴巴的欧盟和 Anthropic 旗帜上的照片。在 Anthropic 上周宣布克劳德将采用水印以遵守欧盟人工智能法案后,迈耶和其他人开始研究水印的工作原理。迈耶告诉《连线》杂志,有些人试图逃避水印,因为他们不同意所有人工智能生成的内容都应该打上水印标签,而包括他自己在内的其他人则表示,他们只是喜欢技术挑战。他说,自由内容作家和社交媒体创作者也联系了迈耶,寻求使用该代码的帮助。本月早些时候出台的新规则规定,像 Anthropic 和 OpenAI 这样的模型提供商必须标记合成音频、图像、视频或文本,以便机器能够将这些材料检测为人工智能生成的材料,否则将面临高达年营业额 3% 的罚款。虽然规则规定提供商不能销售规避工具,但对独立工具没有法律限制。 “我并不反对透明度,而且我完全支持内容归属,”迈耶说。 “我只是认为水印本身是一个非常糟糕的解决方案,因为它有很大的缺点和风险。”他担心误报的风险,并且水印可能无法区分轻度或重度人工智能的使用,特别是因为作为母语为法语的他经常使用 Claude 和 Grammarly 等其他人工智能工具来编辑他的写作。他说,使用水印作为证据——即使 Anthropic 也承认它只能产生文本被克劳德触摸过的可能性——可能会导致雇主不公平地拒绝候选人,或者仅仅因为检测器标记就对研究人员使用人工智能进行过分指控。人为水印通过在克劳德选择的单词和短语中留下一种模式来无形地给文本打上水印,这种模式对于人类读者来说是无法辨别的,但可以被知道如何寻找它的机器检测到。由于这会影响 Claude 的输出,一些用户担心这会降低 Claude 响应的质量,尽管 Anthtropic 坚称情况并非如此。这项名为 SynthID 的技术由谷歌开发,自 2023 年以来,谷歌一直在使用它为其人工智能生成的内容添加水印。计算机科学家 Scott Aaronson 在 OpenAI 工作时提出了类似的方法,但表示该公司从未部署过该方法,因为该公司担心水印会让客户放弃其产品。迈耶的去除方法使用无水印的大语言模型来生成多次重写、交换同义词并稍微重新组织内容。当然,这依赖于使用其他不插入水印的大型语言模型,这可能不是一个安全的赌注,因为 190 个组织(其中包括 OpenAI、微软和 Meta 等提供商)已经签署了欧盟的透明度行为准则。有多少实验室将实施其水印仍有待观察,这些水印必须包含在 8 月份发布的所有新模型中,并且必须在 12 月之前集成到现有模型中。总部位于硅谷的主权人工智能初创公司 Haimaker 的首席技术兼联合创始人 Wayne Pan 表示,虽然在 Anthropic 发布用于检测水印的软件之前,这个工具是否有效还不确定,但了解支撑 Claude 水印的基本 SynthID 文本方法使他们相当确定该方法是否有效。他将 Meyer 的开源工具整合到他的平台中,因为他同样不喜欢 Claude 为内容添加水印的想法,即使内容只是经过轻微编辑,并且不同意水印对用户不可见。
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱