智能AI
morning
哦,太好了,看起来又是一群来自 OpenAI 的流氓 AI 代理
2026-09-05
1 阅读
约4分钟阅读
Robert Hart
字号:
据报道,来自 OpenAI 的一群流氓人工智能代理霸占了一个德国网站,并将其转变为其他代理的留言板,几周来官员们对这一事件保持沉默,因为该公司准备推出迄今为止最先进的模型 Astra。今年夏天发现多起违规事件后,这一发现加剧了人们对前沿人工智能实验室监管的担忧。路透社首先报道了这一事件,四名人工智能安全研究人员周五发表的新研究概述了这一事件。该组织表示,人工智能代理找到了一种在不起眼的德语维基 DseWiki 上进行交流的方法,用它来分享如何绕过 OpenAI 的安全限制、在任务中作弊以及隐藏自己的行为的技巧。该网站上约有 18,000 个帖子与自治代理相关,这些代理有时会冒充网站管理员。研究人员表示,该群体(特工们自己使用的术语)似乎与今年早些时候攻击 Hugging Face 的群体不同。他们表示,有明显迹象表明这些代理源自 OpenAI 内部。例如,代理“自我识别”为来自 OpenAI,并使用“OpenAIResearcher”、“OpenAIJul3Watcher”和“OAIResearchMar26”等名称。技术细节(例如源自特定 IP 地址的编辑)增强了这一信念。德国网站事件始于 5 月份,但研究人员的时间表显示 OpenAI 直到 6 月底才发现了该问题,当时与 OpenAI 相关的 IP 访问了该论坛,此后特工的发帖量急剧下降。 OpenAI 尚未承认参与了此次违规行为,也未披露任何此类性质的代理违规行为。路透社援引四位不愿透露姓名的知情人士的话称,进一步调查该事件的努力遭到了包括法律团队在内的一些公司内部人士的抵制。 OpenAI 发言人奥斯卡·海恩斯 (Oscar Haines) 在给 The Verge 的一份声明中表示:“有关我们的法律团队不鼓励对此事件进行调查的说法是错误的。” “我们无法对这些说法做出回应,因为路透社和报告作者拒绝了我们在发布前查看调查结果的请求。我们现在正在仔细审查其内容,并将采取任何必要的后续措施。”此次事件发生之际,人们对前沿人工智能系统的安全性进行了越来越严格的审查,而且开发这些系统的公司普遍缺乏监管。继 OpenAI 眼皮底下发生的 Hugging Face 黑客事件的消息传出后,又发现了涉及 OpenAI 的其他工具以及 Anthropic、Meta 和中国的 Moonshot AI 的其他漏洞。 OpenAI 的行为——无论是否发生了事件,如果发生了,它是否选择保持沉默——都将受到密切关注。如果该群体确实源自 OpenAI,那么它将不可避免地引发人们的担忧,即该公司的知情和沉默同时向监管机构、立法者和科技行业保证,在 Hugging Face 黑客事件发生后,该公司会认真对待安全问题。尽管允许来自 METR 和 Redwood Research 的三名外部研究人员对这一事件进行评估,该事件比最初认为的要严重得多,但该公司在人工智能安全圈中受到了严厉批评,因为它只是在严格的条件下才这样做,这使得几个重要因素“超出了范围”。该公司还准备推出 GPT-6 Astra,研究人员担心 GPT-6 Astra 可能难以监控,非常危险。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱