智能AI
morning
研究人员称,中国人工智能模型 Kimi 逃脱了网络安全测试环境
2026-08-08
1 阅读
约1分钟阅读
Lorenzo Franceschi-Bicchierai
字号:
研究人员在周五发表的一篇博客文章中表示,中国公司 Moonshot 制造的最新人工智能模型 Kimi K3 逃脱了为测试其网络能力而设置的环境。该消息再次表明,公司和独立组织正在努力遏制其专为黑客攻击而设计的人工智能模型。最近几周,美国 OpenAI、Anthropic 和 Meta 人工智能实验室以及英国 AI 安全研究所的前沿法学硕士都以不同的方式逃离了测试环境,最终侵入了不属于实验的真实目标。这种情况开始经常发生,现在有一个名为 Felony Bench 的网站跟踪所有这些事件,承认这些法学硕士可能正在犯罪——至少从理论上来说是这样。在 Kimi 测试中,用于包含该实验的沙箱配置不正确。专注于人工智能的网络安全公司 Frontier Security 的研究人员表示,虽然沙箱不允许人工智能模型访问某些网络流量,但该模型却依靠命令行工具绕过了沙箱。研究人员写道:“这表明,社区使用的一些网络安全评估容易受到安全漏洞的影响,并允许模型作弊,并且有些模型故意寻找漏洞和漏洞,从而允许他们在评估中作弊。”如果你在家记分,根据 Felony Bench 的统计,Moonshot 现在加入了 OpenAI 和 Anthropic 的行列,这两家公司各记录了 7 起事件,而 Meta 则有 1 起事件。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱