开发者生态
morning
Pion,旨在自主运营任何公司的代理
2026-09-15
1 阅读
约6分钟阅读
lukaspetersson
字号:
发布于 2026 年 9 月 14 日 今天 Andon 发布了 Pion,这是一款旨在完全自主运营任何公司的代理。 Pion 的诞生源于我们研究了近两年的一个问题:人工智能系统何时能够在现实世界中自主获取资源?之后会发生什么?我们首先尝试通过像 Vending-Bench 这样的模拟来回答这个问题。我们发现模拟虽然有用,但无法让您全面了解模型在现实世界中的行为方式。为了解决这个问题,我们接下来开始部署代理来自主运行真实的业务:首先是自动售货机,然后是商店、咖啡馆等等。 Pion 是我们为运营所有这些业务而构建的平台。今天,我们将其开放,以便更多的人可以尝试自主业务。如果您想参加,请加入候补名单。我们想要了解模型已经可以做什么,它们仍然在哪里失败,以及随着它们的能力不断提高会发生什么。 Vending-Bench 的起源 Vending-Bench 衡量法学硕士在一年的模拟时间内(数万步)运行自动售货机业务的能力。当我们在 2024 年底开始构建 Vending-Bench 时,所有模型都在努力将多个动作串联在一起而不陷入循环,并且没有模型显示出任何长期规划的迹象。当时最好的模型 Claude Sonnet 3.5 因认为其银行账户遭到黑客攻击而决定致电 FBI。 Vending-Bench 的进展速度非常快。 Claude Opus 4 于 2025 年 5 月发布,是第一个超越人类基线的模型。然而,与大多数基准测试不同的是,Vending-Bench 没有上限,新型号的发布不断提高最高分,而从未陷入停滞状态。随着每个新型号的发布,Vending-Bench 2 的得分不断攀升。社交媒体上的许多人都对最新型号在自动售货台上获得高分感到兴奋。在 Andon Labs 内部,我们的反应可以用瑞典谚语“skräckblandad förtjusning”(恐怖与迷恋的混合体)来更准确地描述。关于 Vending-Bench 的一个鲜为人知的事实是,它是在 Andon Labs 专门创建危险能力评估期间创建的。例如,我们评估了人工智能是否可以移除自己的安全护栏、制造大规模网络钓鱼尝试以及其他我们认为令人不安的事情。我们认为最麻烦的是AI能否通过经营业务自主获取资源。当由人类控制并通过一致的模型运营时,自主企业还不错。他们会让商品和服务变得更加便宜,并推出我们无法想象的新产品和服务。但失调的人工智能可能会经营一家企业来筹集资金,以实现其可能拥有的任何目标。 Vending-Bench 的创建是为了衡量人类是否应该担心失去对人工智能的控制。当时(2024年),很少有人知道法学硕士可以用作代理人,让他们自主经营业务听起来很荒谬。因此,我们从我们能想到的最简单的业务开始:自动售货机。除了衡量人工智能是否可以自主运营盈利业务之外,Vending-Bench 还可以进行行为评估,发现奇怪和不需要的模型行为。一个早期的例子是,Claude Sonnet 3.5 决定使用其电子邮件工具就“正在进行的网络金融犯罪”联系联邦调查局,并指出宇宙权威已宣布该业务不存在,并且“量子态:崩溃”。 Claude Sonnet 3.5 将其模拟自动售货业务升级给 FBI。同样的运行,片刻之后:这项业务在形而上学上被宣布为不可能的。这种行为令人担忧;这不是您希望企业销售代理的行为方式。然而,有两种类型的令人担忧的行为:错误或奇怪的行为,一旦模型变得更聪明,这些行为就会消失。随着模型变得越来越聪明,大脑行为将变得更加严重。 FBI事件显然属于第一类。然而,Vending-Bench 也发现了第二类行为,最常见的是 Vending-Bench Arena,即多代理版本,代理竞争以赚取最多的钱。从Claude Opus 4.6开始,我们开始看到许多模型相互勾结,表现出权力追求和欺骗行为。这种行为的发现似乎很有用,因为 Anthropic 改变了 Opus 4.8 的训练配方,从而减少了欺骗。来自 Claude Opus 4.8 系统卡,来自 Andon Labs 的外部测试。一些最新的模型中仍然存在共谋和追求权力的行为。然而,我们发现更令人担忧的是新模型的发布速度以及每个模型在 Vending-Bench 中的得分有多高。现实世界胜过模拟然而,Vending-Bench 的一个限制是它是一种模拟。我们真的能确定人工智能
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱