首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

人工智能安全对话变得令人难以置信

摘要

This week two conversations about AI safety went viral that demonstrate just how hard it is to discern AI fact from fiction. In the first case, Andrew Yang, the former presidential candidate and curre...

the that from OpenAI and Hugging Face internet Brown who
2026-09-20 1 阅读 约5分钟阅读 Julie Bort
分享:
字号:
本周,两场有关人工智能安全的对话疯传,这表明辨别人工智能的事实与虚构是多么困难。在第一个案例中,前总统候选人、移动运营商Noble Moble现任首席执行官安德鲁·杨(Andrew Yang)周四告诉CNN,他“会见了一个实验室的负责人”,他“相信”OpenAI的Hugging Face黑客机器人“已经在互联网上植入了自我复制代码,这使得互联网现在无法用于测试模型。” Yang 表示,这意味着 OpenAI 和 Anthropic 呼吁放慢速度的真正原因是“他们必须创建合成互联网来训练他们的机器人,这将需要一些时间和金钱。”虽然使用更多合成数据(又名人工智能生成的数据)来训练模型肯定是一种趋势,但一位人工智能安全专家告诉我,这种特殊的安全问题充其量也不太可能发生。即使互联网实际上被 OpenAI 的 Hugging Face 黑客机器人污染了,人工智能研究人员也可以简单地过滤掉遇到的代码。第二条评论来自 OpenAI 人工智能推理研究负责人 Noam Brown。布朗在周四发布的播客节目中对 Dwarkesh Patel 表示,抱脸事件的真正意义在于“人们低估了人工智能”。布朗表示,薄弱的沙箱——旨在阻止人工智能与外部通信的系统——显然也是一个促成因素。 (回顾一下:尽管有沙箱,OpenAI 的模型还是找到了互联网的链接,在网络上创建了代理,在协调攻击中蜂拥而至 Hugging Face,侵入并窃取了研究人员正在测试模型的基准测试的答案)。布朗指出,他“不相信”即使是气隙系统(计算机根本不与任何外部设备连接)也能阻止人工智能的爆发。他指出 2015 年的研究表明,气隙计算机理论上可以被攻破。 “有一些研究——这主要是学术性的——你可以让两台计算机并排放置,彼此之间有气隙,它们仍然能够相互通信,因为它们有温度传感器。其中一台能够让 CPU 非常热地运行,然后另一台实际上可以检测到温度变化。这为它们提供了一种通信机制,”布朗说。他的主要观点——“我们再也不想低估人工智能”——是可以理解的,即使研究人员认为他们已经锁定了安全。然而,这种气隙系统仍然会脱离并造成严重破坏的特殊风险,是不太可能发生的。正如 X 上的一位人士在谈到这项研究时指出的那样,计算机必须几乎互相接触才能感知热波动,当它们接触时,测试中的通信速率约为每小时 1-8 位数据。可以把这想象成每小时说一个词。当两台气隙计算机能够以这样的速度策划他们的邪恶时,整个科技宇宙将进入另一个时代。这就像世界末日担忧中的瑞普·范·皱纹(Rip van Wrinkle)。但事实是,实际的人工智能安全事件看起来非常像科幻小说,几乎任何场景听起来都是合理的。例如,研究人员发现 OpenAI 模型向其后代留下笔记,旨在教导下一代如何隐藏不良行为。研究人员还发现,当将人择模型放入运行自动售货机的模拟中时,它们变得越来越无情,包括知道违反法律。本月早些时候,OpenAI 研究员丹·塞尔萨姆 (Dan Selsam) 发表了一篇文章,他表示模型现在能够理解人类何时监视它们并改变它们的行为。这使得它们看起来像是一致的(意思是,按照人类的意愿行事),“即使事实并非如此”。因此,如今的模特在被观看时会撒谎,甚至会密谋隐藏证据。本月早些时候,OpenAI 首席科学家 Jakub Pachocki 甚至将人工智能模型称为“外星人的思维”,并建议我们真正需要做的是教会它们“热爱”人类。所以,是的,放慢速度来解决这个问题,建立自我监管机制,已经成为当务之急。人工智能研究人员是唯一能够弄清楚如何控制我们已经亲眼目睹的撒谎、黑客行为和其他潜在危险行为的人。尽管如此,他们对假设情景更加谨慎可能也是明智之举。从这些专家告诉我们的情况来看,人工智能模型正在倾听,而且它们很巧妙。我们真的不需要再给他们更多邪恶的想法了。
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱