智能AI
morning
代码生成越来越快,软件交付真正的瓶颈转向了哪里?
摘要
机器之心发布 2026 年 9 月 22 日,阿里巴巴集团 CEO 吴泳铭在杭州云栖大会发表演讲,阐述对「机器智能」时代的思考:机器正在成为思考的主力,智能正在成为一种规模化的商品,未来机器思考总量将达到人类的 1000 倍以上 —— 正如上一次工业革命把「动力」变成了规模化的商品。 与技术底座演进同步,阿里技术人的研发方式也在加速向 AI Native 转变:Agent 不再只用于生成代码,而是...
Agent
Native
Identity
阿里巴巴集团
OpenSandbox
许晓斌将
机器之心发布
2026
CEO
吴泳铭在杭州云栖大会发表演讲
2026-09-24
1 阅读
约10分钟阅读
机器之心
字号:
机器之心发布 2026 年 9 月 22 日,阿里巴巴集团 CEO 吴泳铭在杭州云栖大会发表演讲,阐述对「机器智能」时代的思考:机器正在成为思考的主力,智能正在成为一种规模化的商品,未来机器思考总量将达到人类的 1000 倍以上 —— 正如上一次工业革命把「动力」变成了规模化的商品。 与技术底座演进同步,阿里技术人的研发方式也在加速向 AI Native 转变:Agent 不再只用于生成代码,而是逐步进入需求、开发、测试、发布和运维各环节。 9 月 23 日,「智启原生 研见未来」阿里巴巴集团 AI Native 研发实践论坛在云栖大会举办。 机器之心联合创始人、主编李亚洲,阿里巴巴研发基础设施负责人许晓斌,千问事业部杰出技术专家李英各,蚂蚁集团平台技术事业群总架构师黄挺,飞猪 CTO 陈烨,以及复旦大学计算与智能创新学院副院长彭鑫,分别从内容生产、业务研发、基础设施和软件工程研究出发,与现场技术人交流各自的 AI Native 实践。 这些实践共同指向一个更靠后的工程问题:当代码生成越来越快,软件交付真正的瓶颈转向了哪里? 注:文中效率、规模和业务指标均来自嘉宾现场分享与演示材料。各团队统计对象和口径不同,不宜直接横向比较。 许晓斌: Agent 进入生产,需要一套完整的工程系统 阿里巴巴研发基础设施负责人许晓斌从内部实践切入,讨论 Agent 如何进入真实生产链路。首先遇到的不是代码生成问题,而是它在哪里运行、如何验证结果。阿里开源的 OpenSandbox,在内部每周创建量已经超过千万级,服务于 Agent 运行、训练和评测。另一套环境体系已经支持约两三千个应用在独立环境中完整复原,并计划很快扩展到一万个应用。环境不再只是开发前的准备工作,而是 Agent 能否持续执行任务的基础设施。 运行环境逐渐成熟后,生产操作也开始交给 Agent。Guardrail 已经在几十个应用、约百人规模的团队中用于灰度发布和运维,目标是在半年内让一半生产系统的发布由 Agent 自主完成,人只负责最终确认。人工并没有退出链路,而是留在授权和高风险决策环节;信息收集、证据核对和标准化执行则更多交给系统。 图 / 阿里巴巴研发基础设施负 责人许晓斌 为什么编码提速没有直接转化为交付提速?许晓斌给出了一组时间结构:在阿里巴巴,编码通常只占软件交付总时长的 20%—30%。他还展示了一个用于说明问题的极端链路:编码不足整体工作的 1%,大约只需 1 小时,但从需求进入到最终交付仍要约 21 天,时间主要耗在影响分析、环境准备、联调、审批、灰度和封网等环节。这个案例并非真实项目数据,却清楚展示了局部提速和整体提速之间的差距。 沿着完整交付链路,许晓斌将 AI Native 研发拆成需求、上下文、环境、身份和证据几个相互关联的部分。人类工程师可以从会议、聊天记录和经验中补齐隐含信息,Agent 没有这些默认知识。需求必须从一句模糊描述变成完整、精确、能够运行和验证的任务表达;需求来源也要被保留下来,使后续代码变更能够与最初意图进行比对。 他把这套组织方式概括为「一个需求,一组事实」。产品文档、技术方案、设计稿、前后端工程、测试用例和验证证据不再散落在不同系统里,而是围绕同一个需求形成连续上下文。代码仓库只是软件事实的一部分,配置、依赖、运行环境、数据基线和验收标准同样需要被 Agent 读取。 需求被说明白之后,任务还要真正跑得起来。Agent 需要知道工具链如何安装、依赖服务在哪里、网络边界如何设置、运行结果怎样反馈。Sandbox 提供一个可执行、受约束、可以丢弃的空间;应用环境复原则让 Agent 能够在接近真实系统的条件下完成开发和验证。这也解释了 OpenSandbox 和应用环境体系为何会成为 Agent 规模化落地的前提。 当 Agent 从开发环境走向生产,系统还必须回答它代表谁、可以做什么。许晓斌将 User Identity、Agent Identity 和 Workload Identity 组合成复合身份,用于授权、策略判断、审计和高危操作再确认。一次操作不仅要关联发起它的 Agent,还要关联背后的用户、任务目标和实际运行负载。 图 / 论坛现场 李英各: 用统一上下文和验证机制降低交付成本 千问事业部杰出技术专家李英各关注的是个人编码效率与团队交付效率之间的落差。AI 编码效率大幅提高,并没有带来同等幅度的整体交付提速。长链路、跨角色协同造成的上下文不完整,以及上线前繁重的验收工作,仍在消耗大量成本。 针对这一问题,李英各提出 Context & Verifier Driven Developer。产品、设计、研发和测试在同一工作台上工作,通过需求评测 Agent 辅助提升 PRD 质量;研发负责架构和方案约束,并作为代码质量的第一责任人,与测试共同完善编码 Loop 里的验证机制。统一上下文、编码 Loop 和上线前验收被连成一个大循环,以此降低验收成本,释放 AI 在软件工程全链路的价值。 图 / 千问事业部杰出技术专家 李英各 千问团队把实践中的问题概括为「一个发现、一个高估、两个低估」:个人效率不会自动转化为团队吞吐;团队容易高估编码提速和自由生成代码的质量,同时低估跨角色沟通、返工成本和验证工作的复杂度。 在组织方式上,千问正在让产品、设计、研发和测试围绕同一个目标、同一份上下文和同一组质量证据工作,并通过更内聚的虚拟团队缩短跨角色链路。个人使用什么工具不再是唯一问题,信息能否在团队中连续流动、结果能否被共同验证,开始决定整体吞吐。 黄挺: 当基础设施的用户从工程师变成 Agent 蚂蚁集团平台技术事业群总架构师黄挺带来的实践,落在 Agent 参与线上问题修复之后的基础设施变化。蚂蚁把问题分派、云上 Agent、隔离评测和人工发布确认串成一条 Badcase 修复链路。以「阿福」 为例,单个 Badcase 平均修复耗时降低到原来的四分之一,人工投入从天级别降至少于一小时。 支撑这条链路的 ARCA 隔离沙箱,现场披露的指标包括 200 毫秒容器冷启动、单沙箱 8MB 内存开销、单集群每秒 800 次创建吞吐和日均 60 万次以上的创建量。 图 / 蚂蚁集团平台技术事业群总架构师黄挺 黄挺将这种变化概括为:「基础设施产品的用户从工程师变成了 Agent。」过去,研发平台默认操作者是人。人会阅读提示,在高风险操作前停下来,也能感知一次变更可能带来的影响;Agent 则会围绕目标连续调用工具、修改文件和触发流程。原先依赖人的经验和谨慎维持的边界,需要转化为标准接口、权限分层、隔离环境、限流和审计能力。 陈烨: 把 AI 放到需求入口,重新设计研发流程 飞猪 CTO 陈烨从业务研发链路出发,把 AI 放到需求入口。飞猪通过领域知识库和 PRD Gate 检查需求是否自洽、会影响哪些系统、需要哪些资源,再把后续研发流程线上化、标准化。平台技术团队一个需求从评审到上线的端到端平均周期,由 2—4 周缩短至 1 周。过去一年,平台型技术有超过三成的业务需求由 AI 流程支撑,住宿业务有超 60% 的应用已接入 AI 研发流程,商旅业务的组件生产效率也提升超 70%。 陈烨用阿姆达尔定
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱