首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
汽车 morning

Anthropic 分享了有关克劳德新水印如何运作的更多细节

2026-08-17 1 阅读 约3分钟阅读 Anthony Ha
分享:
字号:
Anthropic 周五发表了一篇博文,试图回答一些有关如何为其聊天机器人 Claude 生成的文本添加水印的基本问题。例如:水印实际上如何发挥作用?可以通过编辑隐藏吗?这对代码有何影响?自从该公司本周早些时候透露将进行这种水印以遵守欧盟人工智能法案的透明度准则以来,Claude 用户一直在争论这一举措,该准则要求人工智能公司使用能够识别人工智能生成内容的系统。例如,在 Reddit 上,一位发帖者将此描述为针对无辜克劳德用户的阴谋,而另一位发帖者则声称,“你不希望这样做的唯一原因是对人们撒谎。”据 Business Insider 报道,X 上的“数十名”用户声称因此取消了他们的 Claude 订阅。 Anthropic 的新博文首先对水印概念进行了总体概述,并解释说,当做出“低风险选择”时(例如在“阴天”和“灰色”两个词之间进行选择来描述天气),Claude 可以在其响应中创建一种模式,这种模式“读者无法察觉,但任何拥有编码密钥的人都可以察觉”。 “水印不会影响克劳德输出的质量,”该公司表示。 “对于读者来说,带水印的回复与未加水印的回复没有区别。”更具体地说,Anthropic 表示将使用 Google DeepMind 团队在 2024 年概述的 SynthID-Text 方法,并计划发布水印检测 API。它还指出,水印与 Pangram 等公司提供的人工智能检测方法不同,后者在文字中寻找“线索”(例如“这不是 [X],这是 [Y]”的结构)来揭示人工智能的使用情况:“识别这些模式与检查水印有根本不同。”有人可以重写文本来隐藏水印吗? Anthropic 表示这是可能的,但“轻微编辑可能无法完全消除水印”,而“替换每个单词的完全重写则可以”。该公司表示:“当然,在后一种情况下,文本是否可以再被描述为人工智能生成是有争议的。”至于在仅由克劳德校对或编辑的文本中是否可以检测到水印,Anthropic 表示,这将取决于“文本的长度以及克劳德编辑的程度”。如果仅进行了轻微编辑,“几乎所有文字”都将由人类作者编写,并且“几乎没有(如果有的话)可以附加水印。”与此同时,代码的水印应该比其他文本少,因为模型需要创建工作代码,并且不能自由地在各种同等有效的选项之间进行选择。 “话虽如此,在代码中特定单词或术语之间存在任意选择的区域,可以使用水印,例如代码中的注释,”Anthropic 说。 “但根据定义,它对实际生成的代码的影响可以忽略不计。” Anthropic 还表示,Claude 不会是唯一一个生成带水印文本的人工智能聊天机器人,因为“其他主要模型开发人员已经签署了相同的实践准则,并将实施自己的水印。”
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱