智能AI
morning
GPT-5.6今起大降价,最大幅度80%!
2026-08-01
1 阅读
约8分钟阅读
听雨
字号:
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> GPT-5.6今起大降价,最大幅度80%! 听雨 2026-07-31 11:01:21 来源: 量子位 听雨 发自 凹非寺 量子位 | 公众号 QbitAI 突发,GPT-5.6刚刚大降价! 最高立减80%! 入门款 Luna 直接打骨折,每百万Token输入价格从1美元降到0.2美元,输出价格从6美元降到1.2美元。 换算成人民币,相当于输入价格从约6.8元降到1.35元,输出价格从约40.6元降到8.1元。 定位「日常干活主力」的 Terra 也降价20%,输入、输出价格分别降到2美元和12美元。 换算成人民币,分别约为13.5元和81.2元。 只有旗舰模型 Sol ,稳坐原价,但推出了 Fast mode ,速度最高达到标准模式的2.5倍,加速不加价。 自Codex猛猛重置用量之后,降价也给立马安排上了,OpenAI你是要卷死谁… 这价格战直接白热化了。 OpenAI表示,降价是因为 GPT-5.6 Sol自己帮自己省了钱 。 GPT-5.6 Sol参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户~ 左脚踩右脚原地飞升这套,OpenAI你也是玩上了 。 两款降价,一款加速 现在,GPT-5.6三款模型的API价格分别是: GPT-5.6 Luna :每百万Token输入0.2美元、输出1.2美元; GPT-5.6 Terra :每百万Token输入2美元、输出12美元; GPT-5.6 Sol :每百万Token输入5美元、输出30美元。 降价之后,Luna属于一手大跳水。 其输入价格已经和上一代GPT-5.4 nano持平, 输出价格甚至还便宜0.05美元 。 但两款模型干的活不完全一样,GPT-5.4 nano主要面向分类、信息抽取和排序等简单高频任务。 GPT-5.6 Luna则被OpenAI定位为一款面向成本敏感型工作负载的模型,可以调用工具、处理长上下文,执行多步工作流。 简单来说, OpenAI正在把支撑Agent干活的模型,卖到过去简单小模型的价位 。 Terra相对克制,降价20%。 Sol则保持原价,新增了 Fast mode ,速度最高达到标准模式的2.5倍,价格则是标准模式的2倍,模型智能水平不变。 它还会取代此前的Priority Processing。原本使用priority标签的API请求,可以自动切换到Fast mode。 官方表示,这轮调整也会进入Codex和ChatGPT Work。 订阅价格不会下调,用户的额度总量也不会增加,但调用Terra和Luna时,消耗的额度将相应减少。 同样一笔订阅费,可以让模型多干几次活。 OpenAI还顺手把ChatGPT和Codex CLI里的Auto-review模型从GPT-5.4换成了GPT-5.6 Luna。 Auto-review负责在后台检查代码和修改结果,属于典型的高频Agent任务。 结合模型升级和Luna降价,OpenAI预计 其成本将降至原来的约十分之一 。 便宜模型不再只负责分类、抽取这些传统「杂活」,而是开始进入代码审查、后台监控等需要判断和工具调用的环节。 目前三款模型的定位是: 预算敏感、调用量大的任务交给 Luna ; 普通日常工作交给 Terra ; 高难度任务继续使用 Sol ; 如果连等待都嫌慢,再花一倍的钱购买速度。 GPT-5.6开始参与给自己降本 为啥突然降价? OpenAI表示,原因是 GPT-5.6 Sol参与了自家生产系统的优化 。 它所提高的效率,进而转变成了价格表上打折的数字。 具体而言,GPT-5.6 Sol重写和优化了部分生产环境GPU Kernel,设计并运行数百次Token生成实验,还参与监控训练,在出现问题时介入。 最后成绩也很突出:生产GPU Kernel优化,让GPT-5.6端到端服务成本下降20%;改进推测解码,让Token生成效率提升15%以上。 GPU Kernel 可以理解为模型在GPU上执行具体计算任务的底层程序。 模型本身不用变,只要这些程序写得更高效,同一块GPU就能更快完成计算,处理更多请求,单次调用成本也会跟着下降。 推测解码 则是在生成答案时,先批量「猜」出接下来可能出现的Token,再交给主模型验证。猜得越准,需要逐个生成和等待的步骤就越少。 两项优化都没有降低模型能力,却能让同一个模型跑得更快、更便宜。 不过,这还不是GPT-5.6完全自主升级自己。 OpenAI特意强调,整个过程仍然由人类主导。 模型可以写代码、跑实验、监控异常,但目标怎么定、结果能不能用、代码是否进入生产环境,依然需要 「Human in the Loop」 。 OMT 最后,还有一个新变化。 这次降价有一个很具体的落点: Agent工作流 。 打折最狠的Luna,并不只是用来做分类、抽取的传统小模型。 按照OpenAI的定位,它可以调用工具、执行多步任务,主要面向高频、成本敏感型工作负载。 因此,Luna降价80%,也是在 降低Agent长期运行的门槛 。 让原本因为成本太高而不能频繁执行的审查、验证和监控任务,有机会变成工作流里的常规步骤。 再结合GPT-5.6参与优化自身生产系统,一套新的循环出现了: 模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。 OpenAI这套 降价飞轮 ,已经雏形初现。 这一通操作下来,现在压力直接给到A社: 「轮到你了。」 参考链接: [1]https://x.com/OpenAI/status/2082878156483219672 [2]https://x.com/sama/status/2082880720989532597 版权所有,未经授权不得以任何形式转载及使用,违者必究。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱