智能AI
morning
人工智能减速实际上是如何实施的
摘要
Many AI researchers seem to firmly believe that the technology they are developing could someday prove very dangerous . What’s less clear—even among AI’s technical elite —is precisely how to keep thes...
the
and
that
are
Anthropic
The
even
years
for
new
2026-09-19
1 阅读
约4分钟阅读
Will Knight
字号:
许多人工智能研究人员似乎坚信,他们正在开发的技术有一天可能会变得非常危险。不太清楚的是如何控制这些反复无常的算法,即使是人工智能的技术精英也是如此。近年来,研究人员提出了各种想法来防止人工智能变得令人讨厌。其中包括争议较小的计划,例如更严格的政府监管、衡量进展的新方法以及探索模型的内部运作方式,以及更古怪的建议,例如将跟踪设备放置在 GPU 内,甚至仪式性地销毁大量人工智能芯片。然而,随着政治和公众要求采取更加谨慎的方法来构建人工智能的压力越来越大,保持人工智能安全的答案仍然不清楚。多伦多大学人工智能研究员雷蒙德·道格拉斯 (Raymond Douglas) 表示:“我们需要开始将其视为一个研究问题。”雷蒙德·道格拉斯 (Raymond Douglas) 是题为“探索前沿,一项研究议程”的新报告的合著者,该报告警告称,减缓人工智能发展仍然是一个未解决的难题。 “我们并不真正了解我们的选择是什么,也不知道它们会做什么。”最近几周,一位人类研究人员离开公司并警告说,人工智能可能会在几年内消灭人类,因此关于人工智能末日的讨论达到了白热化的程度。 Anthropic 人工智能安全实验室负责人迅速回应了他的担忧。美国大型人工智能公司的领导人——Anthropic的达里奥·阿莫迪(Dario Amodei)、OpenAI的萨姆·奥尔特曼(Sam Altman)、SpaceXAI的埃隆·马斯克(Elon Musk)和谷歌DeepMind的德米斯·哈萨比斯(Demis Hassabis)——现在都纷纷插话,为某种人工智能放缓或暂停提供支持。这个问题似乎特别紧迫,因为人工智能公司现在正在利用人工智能本身来构建更强大的模型。这引发了人们对加速递归自我完善(RSI)循环的担忧,这种循环将使人工智能在几年内超越人类理解其能力的能力。人工智能实验室已经在宣传自己的新方法。本周,Anthropic 宣布了几种新方法来追踪人工智能的发展速度(也许是危险的)。例如,这些技术显示,Claude 现在完成了 Anthropic 26% 的人工智能研究,而 2026 年初为零。他们还透露,Anthropic 花费了 6% 的计算预算来研究如何使其人工智能更安全。但道格拉斯和其他专家表示,有效、可靠地控制人工智能开发将需要人工智能实验室外部的资金和专业知识。这份最新报告及其他报告中提出的一些解决方案似乎比其他解决方案更容易实现。 “独立”评估者人工智能公司经常提出的一个想法是让第三方评估者更好地访问他们的模型。这些评估者测试模型以评估他们的能力,并通过尝试在可信环境中引发不当行为来“红队”他们。英国人工智能安全研究所前首席科学家、谷歌 DeepMind 研究员杰弗里·欧文 (Geoffrey Irving) 认为,严格的检查可能会暂时阻止前沿人工智能的发展。 “在短期内,检查和审计会发挥作用,甚至只是相互协议,”欧文说。 “我确实认为这些公司害怕 RSI 和起飞失准。”一些末日论者认为,此类检查需要比目前更加独立和科学严谨。一些人工智能代理最近在测试期间逃脱了收容,这一事实似乎表明可能需要更严格的要求。倡导人工智能控制的非营利组织 Control AI 的负责人康纳·莱希 (Connor Leahy) 表示,检查应由联邦调查局 (FBI) 或国家安全局 (NSA) 参与。 “当[大型人工智能公司]说‘独立评估者’时,他们的意思是‘我想付钱给住在我集体宿舍里的朋友看我的提示。”
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱