智能AI
morning
OpenAI 寻求通过新的客户隐私保护来超越 Anthropic
摘要
As AI models have become more powerful, the potential for those models to be misused has grown — as has a clamor for safety guardrails that can stop such abuse from happening. AI companies must now wa...
the
for
models
that
data
has
customers
OpenAI
policy
and
2026-08-20
1 阅读
约4分钟阅读
Lucas Ropek
字号:
随着人工智能模型变得越来越强大,这些模型被滥用的可能性也随之增加——人们对安全护栏的呼声也越来越高,以阻止这种滥用的发生。人工智能公司现在必须在尊重企业客户的隐私和监视使用情况是否可能出现问题之间保持微妙的平衡。 OpenAI 意识到有机会超越竞争对手 Anthropic,因此刚刚宣布了一种以隐私为中心的安全方法来监控滥用行为。该公司正在向特定客户预览一项名为“私人安全处理”的新服务。这是一个自动化系统,可以监视潜在的滥用行为,同时不保留任何客户数据。该系统显然与 Anthropic 最近宣布的数据保留政策背道而驰。这项政策激怒了一些客户,它使人工智能实验室能够将用户数据(所有会话以及其中的对话)保留 30 天(涉及“涵盖的模型”)。该公司表示,这些型号包括所有 Mythos 级型号和“具有类似功能的未来型号”。这项政策于 7 月宣布,旨在确保安全,允许实验室筛选和分析潜在的不当行为。然而,一些处理大量敏感数据且不希望人工智能实验室保存(或检查)这些数据的企业深感担忧。与大多数其他人工智能公司一样,OpenAI 已经通过遵守“零数据保留”政策为客户提供了相对水平的隐私。 ZDR 使用 OpenAI API 中的代理来监控每个会话的滥用情况。通过这种方式,公司不会保留客户数据,但公司仍然能够扫描不良活动,而无需人工干预。值得注意的是,Anthropic 在很大程度上也遵守 ZDR——除了像《神鬼寓言》这样的“涵盖模型”。 OpenAI 表示,私人安全处理是一项扩大 ZDR 范围的新技术。它将其描述为一种长期安全监控的形式,可以评估多个对话的输入和输出——而不仅仅是一个。同样,监控是由代理进行的,如果被触发,代理会捕获交互并分析会话之间的潜在滥用迹象。一位发言人告诉 TechCrunch,这项新技术可帮助 OpenAI 检测在多个会话中发生的对人工智能的恶意使用。不良行为者(假设有人试图为网络攻击设计恶意软件)可能会传播他们的请求以避免被发现。私人安全处理可以分析这些多个对话是否存在滥用迹象,而无需人工审查用户的对话。该公司表示,在系统被触发的情况下,它可能会向 OpenAI 发送“狭义信号”,警告特定类型的活动。根据该信号,OpenAI 可以决定是否“有必要执行”。该发言人表示,如果是这样,OpenAI 将与客户联系以获取更多背景信息或与他们合作解决该问题,客户可以自行决定选择与 OpenAI 共享数据。相比之下,Anthropic 指出,可以对客户数据进行人工审核,但只能“通过受控访问路径”进行,其中涉及“一小部分经过批准的审核者”。该公司表示,每一次审核会话都“记录在防篡改日志中,审核者无法压制或修改”。目前,OpenAI 和 Anthropic 之间的企业竞争非常激烈,两家公司都在寻找任何机会来获得对对方的优势。最近的一份报告显示,OpenAI 第二季度的增长速度比 Anthropic 慢。据报道,Anthropic 的年化收入运行率为 650 亿美元。 Anthropic 投资者表示可能以 2 万亿美元的价格进行 IPO,而 OpenAI 也正在筹备 IPO。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱