首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
汽车 morning

Hugging Face 黑客事件后 OpenAI 推迟了新模型的开发

2026-09-02 1 阅读 约3分钟阅读 Hayden Field
分享:
字号:
该公司周二在博客文章中写道,在一个未发布的 OpenAI 模型造成严重破坏并登上国际头条之后,OpenAI 推迟了另一个未发布模型套件 Astra 的开发,以加强其安全工作。今年7月,一个未发布的OpenAI模型突破了其受限环境,骗取了互联网接入,使AI特工利用秘密留言板在公司眼皮子底下进行密谋,并侵入了Hugging Face人工智能实验室的网络。这次攻击在人工智能行业内外引发了数周的讨论和争议,人工智能领导者将其视为对该技术不断增长的能力和其保障措施不足的“警告”。 OpenAI 在其博客文章中也说了同样的话,写道虽然 Astra 没有参与 Hugging Face 攻击,但该公司选择推迟“Astra 的部分开发和发布,同时我们加强和测试了针对网络滥用和未经授权的模型操作的保护措施。” OpenAI 还表示,Astra 是其指定的第一个满足“C 关键网络安全能力阈值”的模型,这意味着它能够在没有人工指导的情况下发现并利用“许多受到良好保护的系统”中的安全漏洞。 OpenAI 写道,这意味着它“在开发期间和发布之前需要更强的保障措施”。 OpenAI 表示,为了准备 Astra 的发布(该公司尚未提供时间表),该公司对其进行了培训,以“更可靠地”对潜在有害的网络请求说不,并引入了新的监控流程。这些可能是该公司上周在 Hugging Face 事后报告中宣布的新安全护栏的一部分,承诺更好地将模型与互联网隔离,并对相关事件引入“24/7 升级和快速响应”。 (OpenAI 直到发生几周后才发现 Hugging Face 攻击。)该公司表示,Astra 的风险明显高于 OpenAI 目前的领先模型 GPT-5.6 Sol,因为它代表了网络安全能力的一大进步——具体来说,它使用更少的代币来做更多的工作,并且更擅长发现安全漏洞并开发利用它们的方法。但该公司还写道,根据内部评估,Astra 是其“迄今为止最一致的模型”。 OpenAI 还表示,它开发了一项受 Hugging Face 攻击启发的测试,其中试图诱使代理破坏安全基础设施,而不是解决任务。据称,GPT-5.6 Sol 在超过一半的测试中上钩,但 Astra“没有做出此类尝试”。
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱