智能AI
morning
人工智能行业已经发生了悲惨的转变。现在怎么办?
2026-09-15
1 阅读
约2分钟阅读
Will Douglas Heaven
字号:
这种协调一致的努力实际上可以实现什么目标?再次考虑拥抱脸部攻击。 OpenAI 表示,驱动大多数流氓代理的模型是其正在内部测试的“高度持久”的下一代模型。他们的暗示似乎是 OpenAI 建立的模型太好了,但很危险。但如果你读过 OpenAI 和 METR(OpenAI 聘请第三方公司来帮助他们了解发生的情况)发布的有关 Hugging Face 黑客攻击的报告,你得到的印象不是模型太强大,OpenAI 无法跟上,而是 OpenAI 无法正确训练的损坏模型。这些特工们做了他们所做的事情——包括互相留言、将工作委派给其他特工,以及在他们的环境中寻找任何可能完成任务的方法——因为他们在训练期间因为做了这些事情而获得了奖励。训练设置中也存在错误,例如无法完成的任务,这促使模型找到意想不到的解决方法,并获得奖励。当时,其中许多问题都被忽视或未报告。 OpenAI 表示,它已经停止训练这个新模型并将其锁定。这听起来就像是笼中了一头危险的野兽。事实上,OpenAI已经搁置了一款有缺陷的产品。这并不是说有缺陷的产品不会有危险。过去,损坏的软件甚至导致过人员死亡。但随着有关经济放缓的讨论愈演愈烈,值得记住的是,这一切都是自己造成的。经济放缓可能会产生一些无私的副作用。但这主要会让这些科技巨头有机会清理自己装配线上的混乱局面。这些前沿实验室的透明度将是任何有意义的改革、限制或监管人工智能努力的关键。否则,我们其他人仍然只能听到他们所建造的东西及其安全性的说法——无论他们以何种速度前进。为了继续讨论人工智能最新的末日时刻,请与我和我的同事一起参加明天(即美国东部时间 9 月 15 日上午 11 点)订阅者专享的圆桌讨论。我们希望在那里见到您!
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱