首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

摘要

当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。 在高频高速的极端情况下,赛车需要在极短时间内完成定位与感知,判断周围对手的位置和意图,预测几秒后的交互结果,并决定是超车、防守还是减速;与此同时,所有决策又必须受到轮胎附着、车辆动力学、执行器能力和稳定性边界的严格约束。 一旦认知判断出现偏差,可能迅速演化为真实的物理失稳;而物理...

A2RL Cognitive Physical Limit Kinetiz 2025 当自动驾驶赛车以近 300 的时速在 赛道上与周车进攻防守
2026-08-21 1 阅读 约10分钟阅读 机器之心
分享:
字号:
当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。 在高频高速的极端情况下,赛车需要在极短时间内完成定位与感知,判断周围对手的位置和意图,预测几秒后的交互结果,并决定是超车、防守还是减速;与此同时,所有决策又必须受到轮胎附着、车辆动力学、执行器能力和稳定性边界的严格约束。 一旦认知判断出现偏差,可能迅速演化为真实的物理失稳;而物理能力边界的变化,也会反过来改变智能体能够选择的决策空间。 这正是 新加坡南洋理工大学 AutoMan Lab 团队 试图探索的问题:具身智能体在真实世界的极端工况下进行一体化感知、定位、预测、决策和控制的能力边界在哪?它的认知极限与物理极限又将如何相互影响? 围绕这一问题,团队以自动驾驶方程式赛车为实验平台,构建了一套 以世界模型为中心的极限具身智能体架构 。不同于将感知、预测、规划和控制看作彼此独立的模块,该系统利用世界模型同时预测对手交互、自车动力学以及可行运动范围,并通过真实赛车数据与内部仿真的闭环持续优化智能体。 Title: Toward the Cognitive-Physical Limits of Embodied Intelligence through a World-Model-Centric Autonomous Racing Agent Affiliation: 1) School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore; K2 Holding, L.L.C, Abu Dhabi, United Arab Emirates arXiv: arxiv.org/abs/2608.10618 以自动驾驶赛车为平台, 探索具身智能体的认知物理极限 具身智能的核心,是智能体通过与真实物理世界持续交互完成感知、理解、决策和行动。但目前大量机器人和具身智能研究,仍主要运行在相对保守的安全裕度或中等复杂度环境中。这对于验证算法“能不能工作”非常重要,却很难回答另一个更根本的问题: 在真实世界部署时,智能体 运行 的安全性、可靠性边界在哪? 研究团队将这一问题拆解为两个相互耦合的方面。 认知极限(Cognitive Limit) ,描述智能体在高速、动态和不确定环境中 构建和更新对世界的理解,并据此进行预测和决策的能力。 对自动驾驶赛车而言,它包括高速定位与感知、对手交互预测,以及在极短时间内选择安全可行且具有竞争力的决策。 物理极限(Physical Limit) ,则描述智能体真正能够执行出来的运动范围。它受到车辆动力学、轮胎—地面作用、执行器能力、空气动力学、路面摩擦、轮胎温度和稳定性等因素共同约束。 关键在于,这两类极限并不是彼此独立的。 在赛车场景中, 智能体需要同时面对高强度 的对抗性交互,以及近极限动力学控制 : 车辆需要在极短时间尺度内完成定位、感知和状态估计;需要不断判断其他车辆未来可能采取的行为;同时,其控制动作又受到轮胎附着、执行器能力和车辆稳定性的严格约束。当车辆接近物理极限运行时,任何认知误差都可能迅速转化为物理风险;而物理性能边界的变化,又会直接改变智能体能够选择的决策空间。 因此, 自动驾驶赛车不仅是验证自动驾驶系统性能的重要平台,也为探索具身智能认知与物理的耦合能力边界提供了天然平台 。 A2RL:把具身智能放进高速、强交互的真实物理世界 本研究依托 全球最大规模的 F1 级别自动驾驶方程式赛车联赛(A2RL) 开展。A2RL 采用统一的全尺寸 Super Formula 赛车平台,将自动驾驶系统直接置于高速、近极限和多车交互环境中,并构建了从高保真仿真到全尺寸实车验证的完整赛事体系。 随着赛事规模持续扩大,参赛车队由最初的 8 支扩展至 11 支,参与团队来自 德国、意大利、美国、日本、法国、中国 等国家,涵盖汽车工程与人工智能领域的国际顶尖科技公司、高校和科研机构。 Kinetiz 车队由南洋理工大学、阿联酋 AI 科技公司 K2,以及 ALP Autonomy 联合组建 。 在线上仿真赛事中,Kinetiz 先后在 Autonodrome、Yas Marina North 等分站取得冠军,获得 2025 年度 SIM-Sprint 总冠军 。在线下阿布扎比全尺寸实车赛事中,赛车实现了接近 260 km/h 的高速自动驾驶,并成功在阿布扎比亚斯码头 F1 赛道举行的 Grand Final 中获得了 2025 年度全球第四(亚洲第一)的好成绩。 更重要的是,持续进行的仿真和实车赛事为团队积累了大量普通实验环境很难获得的数据——其中既包括高速稳定运行、超车与防守等成功案例,也包括接近失稳甚至出现失控风险的极限工况。这些数据成为世界模型持续学习的重要基础。 以世界模型为中心的自动驾驶赛车智能体 传统自动驾驶系统通常沿着「感知—预测—规划—控制」的链条逐级工作。 但在接近极限的赛车环境中,一个模块的微小误差可能迅速传递到下游。 一个从当前状态看起来合理的超车动作,几秒后可能因为对手封堵路线而变成碰撞;一个几何上可行的轨迹,也可能因为轮胎已经接近附着极限而无法真正执行。 因此,团队把 世界模型(World Model)放到了整个智能体的中心 。这个世界模型同时描述三件事: 一是 外部交互将如何演化 ——例如对手可能加速、防守、让行还是保持当前路线; 二是 自车会如何响应 ——不同油门、制动和转向输入会导致怎样的速度、横向加速度、横摆和侧偏变化; 三是 当前还能做到什么 ——也就是在当前速度、摩擦、轮胎温度和车辆状态下,哪些运动仍然处在可行范围内。 有了这样的内部预测模型,智能体不再只根据「现在看到了什么」做决定,而是可以在真正执行之前,先在内部推演多个未来。 先在世界模型里「想一遍」,再决定怎么开 在决策阶段,系统首先生成一条主要决策轨迹,并围绕它形成多个不同策略的候选轨迹。随后,世界模型对这些候选方案分别进行前向推演。 如果选择左侧超车,对手可能怎样响应? 如果继续加速,几秒后的车辆动力学状态是否仍然可控? 某条路线虽然更快,但是否会让车辆进入不可行的动力学区域? 系统综合 交互安全性、物理可行性和速度效率 对未来结果进行评分,在真正执行之前过滤掉高风险动作。 在真实轮对轮超车数据中, 世界模型预测的对手运动与实际交互过程具有较好的一致性 。消融实验则显示,在相同场景下,带有世界模型的智能体能够提前识别潜在碰撞风险,而缺少未来预测时,一个当前看来合理的动作可能最终导致碰撞。这体现了世界模型在极限环境中的一个重要作用: 把「未来可能发生什么」提前纳入当前决策。 从认知极限走到物理极限 预测出合理动作还不够,最终还必须让真实车辆做得到。为此,团队进一步利用世界模型描述车辆随速度和运行状态变化的 可行加速度包络 。 随着赛车速度变化,横向加速度、制动能力和驱动能力都在变化。与此同时,轮胎温度、路面摩擦以及模型预测误差也会让实际可用的物理极限发生改变。 控制器利用这些动态变化的物理边界约束车辆运动,使规划出来的轨迹最终能够转化为真实可执行
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱