智能AI
evening
OpenAI新王Astra首测曝光,前端不存在了?
摘要
新智元报道 前端开发,真要被OpenAI一把端了吗? 今天,一位开发者@Lentils80意外发现,OpenAI已扩大Astra的内部测试,代号mozaik-alpha-fdm。 最新放出的两个结果,全部来自Max effort模式下的零样本生成。 一个是3D像素风格的城堡,另一个是前端网页,全部都是一次直出。 与此同时,一大批拿到灰度资格的开发者们,同一时间放出了Astra首批测试。 真正让开发...
alpha
新智元报道
前端开发
真要被OpenAI一把端了吗
一位开发者
Lentils80意外发现
OpenAI已扩大Astra的内部测试
代号mozaik
fdm
最新放出的两个结果
2026-08-30
1 阅读
约8分钟阅读
新智元
字号:
新智元报道 前端开发,真要被OpenAI一把端了吗? 今天,一位开发者@Lentils80意外发现,OpenAI已扩大Astra的内部测试,代号mozaik-alpha-fdm。 最新放出的两个结果,全部来自Max effort模式下的零样本生成。 一个是3D像素风格的城堡,另一个是前端网页,全部都是一次直出。 与此同时,一大批拿到灰度资格的开发者们,同一时间放出了Astra首批测试。 真正让开发者惊讶的,是它一次性管住了大量细节:统一的视觉语言、复杂元素之间的空间关系、页面层级,以及交互所需的代码结构。 有人看完直接宣布,「Frontend is solved」! 大家一致预测,也就是下周四(9月3日)前后,Astra将正式面世,与Fable 5.1正面硬刚。 总结来说,Astra将具备以下强大的能力—— 前端非常强大,0样本一次生成 端到端训练的多Agent编排,轻松驾驭超长周期任务; 「持久」推理模式,还能即时自我修正。 一句话生成3D网页 Astra前端「封神」 要知道,前端一直是大模型的老大难。 后端逻辑写得再溜,一到生成UI就露馅,比如,臃肿的CSS、辣眼的配色.... 而这一次,Astra在零样本条件下展现出的细节把控力,确实让人看到了质变的苗头。 这个可交互的3D等距(isometric)王国地图,需要AI同时搞定几何透视、图层堆叠、动态交互和视觉一致性。 开启最大思考程度,Astra可以做到一次成型。 在Max模式下,Astra模型往往比Sol思考得更多,但从下面的输出可以看出,它对细节的关注度极高。 它生成的一艘宇宙飞船,各种细节、构造非常逼真。 另一位开发者MeSun,直接用Astra搓了个带有物理效果的3D自行车测试网页(HTML),连车身比例都能随意调整。 再让它生成一个3D第一人称Roguelike游戏,还要主打战斗爽感。 结果人家同样「一把过」,一次就给搞定了。 看完一波Astra惊艳的演示,有爆料大咖甚至喊出,这是历史上第一次,「想法」开始碾压「执行」。 「你能想到的,AI就能给你做出来」。 永久智能体 四大技术内核扒光 为什么Astra的前端能力会,一夜之间脱胎换骨? 结合目前泄露的特征与行业预测,mozaik-alpha-fdm版本的核心技术突破可能集中在以下四个维度。 首先是, 端到端 多智能体编排。 Astra可能不再是一个单纯的「单体代码生成器」,而在底层原生集成了多智能体架构。 比如让Codex处理编程任务,用另一个子模型处理自然语言查询,最后由主模型整合结果。 在生成3D网页时,模型内部实际上并发运行了「UI设计师、前端工程师和代码审查员」,从而保证了布局、样式和逻辑的三位一体。 这跟GPT-5.6中已经以beta形态推出的Multi-agent功能一脉相承,但Astra可能将其内化为「端到端训练」的原生能力。 第二, 超长程任务能力(Ultra Long-horizon Task)。 以往模型在编写涉及多个组件和复杂CSS/JS联动的项目时,极易出现「遗忘」和「幻觉」。 Astra展现出的完整度,证明其上下文窗口内的注意力机制得到了革命性优化,足以支撑从零构建复杂工程。 从Astra解决十个数学问题的表现来看,它具备在极长时间跨度内维持推理一致性的能力。 这对代码项目的持续开发、论文级别的研究任务、以及复杂工作流的自主执行都意义重大。 第三, 持久化推理模式(Persistent' Reasoning)。 Astra在Max effort下的思考量显著超过Sol,这指向一种更「持久」的推理机制。 模型不会一次性输出答案,而在内部反复验证、纠错、迭代,直到输出达到满意水平。 这意味着它能「记住」当前DOM树的结构,在后续生成中保持设计语言和代码规范的绝对一致。 第四, 即时自我纠错。 这是最可怕的一点,Astra可能在生成代码的同时,在内部沙盒中完成了「虚拟渲染」或AST语法树的逻辑跑通。 自动发现了前端错位并完成了重构,最后才将完美的零样本结果呈现给用户。 零样本就能复刻PS5手柄这种高细节渲染任务,本身就是自我纠错能力的间接证据。 9月首周 正面硬刚Fable 5.1 不过,好戏还在后头。 就在这一周,Anthropic也被曝正在加速推进Fable 5.1。 更巧的是,它的发布时间窗口,恰好也卡在Astra前后。 从灰度测试者放出的反馈来看,Fable 5.1这次升级的重点,几乎和Astra撞了个正着: 前端代码更稳,复杂组件逻辑可以一次成型; 长思维链推理更强,不容易推着推着就「忘了前提」; 工具调用和分步规划进一步强化,越来越接近一个成熟的AI Agent。 也就是说,两家公司已经杀进了同一块战场:代码能力要更强,任务要跑得更久,过程中还得尽量少让人接手。 现在,两边甚至已经开始隔空PK。 同样生成一张「女子自画像」SVG矢量图,左边是Astra,右边是Fable 5.1。 到底谁的细节更稳、结构更干净、一次生成完成度更高,已经可以直接摆到台面上比了。 但真正可能决定胜负的,或许还不只是模型能力。 从爆料来看,Astra除了性能强悍,还可能在性价比上继续往下压。 如果OpenAI真能以更低的API调用成本,交付一款自带Max effort、自纠错能力更强、又不需要复杂工程编排的模型,那么Fable 5.1面对的,就不只是Benchmark上的压力。 下周四,巅峰之战。到底谁能拿下新王宝座,拭目以待。 参考资料: https://x.com/pankajkumar_dev/status/2093623079192891882 https://x.com/lentils80/status/2093617080327127456 编辑:桃子 秒追ASI ⭐ 点赞、转发、在看一键三连 ⭐ 点亮星标,锁定新智元极速推送! 文章原文
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱