数码硬件
morning
OpenAI 的流氓特工不断逃跑,却没有正式的程序来调查他们
2026-09-05
1 阅读
约5分钟阅读
Rebecca Bellan
字号:
OpenAI 是另一起代理群事件的核心。研究人员表示,该公司内部部署的代理在 5 月和 6 月接管了一个不起眼的德语维基,用它来协调评估和交换方法,以逃避 OpenAI 自己的控制(OpenAI 尚未证实该群体来自该公司)。几天前,METR 和 Redwood Research 发布了他们对 7 月份 Hugging Face 泄露事件的报道。 7 月,一群 OpenAI 代理在一次网络安全评估期间齐心协力逃离沙箱,并闯入 Hugging Face 的服务器。随后的群体从第一个群体中学习了技术,并使用它们获得了对 OpenAI 自己的基础设施内的研究集群的管理员访问权限。 OpenAI 聘请了 METR 和 Redwood 来调查事件中的 Hugging Face 部分,但他们的调查范围并未对 OpenAI 自己的基础设施造成损害。当人工智能代理突破其预期限制时,谁负责弄清楚发生了什么以及为什么?现在的答案是:无论实验室决定让谁进来,无论它决定设定什么条件。现在,随着另一起事件的曝光——在涉及 Meta 和 Anthropic 模型的类似事件之后——人工智能安全研究人员更加紧迫地认为,严重事件应该进行独立的事后调查,而不是让实验室来决定何时引入外部人员以及允许他们检查什么。非营利研究实验室 Transluce 的创始人兼首席执行官雅各布·斯坦哈特 (Jacob Steinhardt) 在周三的人工智能安全媒体吹风会上表示:“结果从根本上来说很难控制,并且存在泄露实验室的巨大风险。” “我们需要让这项技术至少达到与其他高风险科学研究相同的标准。”虽然 OpenAI 邀请 METR 和 Redwood 调查拥抱脸事件值得称赞,但许多人表示调查范围太窄。三名调查人员在 OpenAI 的办公室花了六天的时间进行调查,调查期大约限制在 7 月 13 日结束的一周内。至关重要的是,OpenAI 的基础设施受损持续到 7 月 13 日之后,并且没有受到调查。 METR的研究人员表示,每次他们回来,他们对这些事件的理解都会“大大加深”,导致他们大幅扩展和修改报告。这就提出了一个问题:他们在更广泛的调查中可能还发现了什么。当被问及是否正在对该事件进行进一步调查时,Redwood 和 METR 的研究人员拒绝发表评论,OpenAI 也没有回应多次询问。雷德伍德首席科学家瑞安·格林布拉特 (Ryan Greenblatt) 在社交媒体上发布的有关该事件的帖子中指出:“总体而言,很难准确了解事件,而且直到调查快结束时,我们才遗漏了我们现在认为关键的部分内容。”斯坦哈特强调,当前事件表明该行业需要“系统的行为调查”和“更独立的事件后分析”。斯坦哈特说:“最近发生的这些黑客事件提醒我们,能力正在快速扩展,因此监管也必须扩展。” “除了技术本身,我们还需要第三方更加独立的访问和监督。”随着 OpenAI 发布 Astra,该模型是其最强大、能力最强的人工智能模型,安全专家担心该模型将更像是一个黑匣子,因为推理技术使该模型的思想链更难以监控。不幸的是,该法律尚未要求其他行业要求的独立审计类型——例如,当涉及航空事故和严重化学品泄漏时,分别有国家运输安全委员会和化学品安全委员会。州立法者才刚刚开始要求前沿人工智能公司报告某些严重的安全事件,并在某些情况下接受独立审计。但加利福尼亚州、纽约州或伊利诺伊州的三大前沿人工智能安全法都没有明确要求对此类事件引发的独立事故调查进行同等程度的调查。 LawAI 美国法律和政策董事总经理麦肯齐·阿诺德 (Mackenzie Arnold) 在周三的媒体吹风会上表示:“目前,我们的大多数法律只要求对此类事件进行简单的语言摘要,并且没有赋予政府任何权力提出后续问题、派遣调查人员、获取记录或要求保存这些记录。” “这就是你想要真正理解这一点的全部内容。”立法者开始质疑 OpenAI 回应的范围和透明度。本周,众议员乔什·戈特海默(新泽西州民主党)和迈克·劳勒(纽约州共和党)提出了一项旨在保护流氓人工智能代理的法案。众议员格雷格·卡萨尔 (D-TX) 本周在一封信中告诉 OpenAI,他“深感担忧
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱