智能AI
morning
Kimi去了,Anthropic换了一个东西?
摘要
大模型的定价权,正在从“谁强谁贵”转向“谁难替代谁贵” 出品 | 妙投APP 作者 | 张贝贝 编辑 | 丁萍 头图 | AI制图 过去两周,大模型行业的定价逻辑,被两股力量同时撬动。 7月17日,月之暗面发布Kimi K3。2.8万亿参数MoE架构,输出定价100元/百万token,较前代 (K2.6/K2.7的27元) 涨价超3.5倍,却仍不到Anthropic旗舰Fable 5的一半。发布后...
谁强谁贵
7月17日
输出定价100元
5的一半
Opus
定价仅后者一半
Kimi
半价推新
替代成本
总体拥有成本
2026-08-04
1 阅读
约10分钟阅读
虎嗅
字号:
大模型的定价权,正在从“谁强谁贵”转向“谁难替代谁贵” 出品 | 妙投APP 作者 | 张贝贝 编辑 | 丁萍 头图 | AI制图 过去两周,大模型行业的定价逻辑,被两股力量同时撬动。 7月17日,月之暗面发布Kimi K3。2.8万亿参数MoE架构,输出定价100元/百万token,较前代 (K2.6/K2.7的27元) 涨价超3.5倍,却仍不到Anthropic旗舰Fable 5的一半。发布后外网开发者社区迅速炸开,大量对比帖与吐槽涌现,有人直言“已将Claude API切至Kimi”。 一周后,Anthropic推出Claude Opus 5。性能逼近旗舰Fable 5,定价仅后者一半。 而Opus 5发布同一天,黄仁勋在X上发出首条推文,联合微软、Meta等数十家机构签署公开信《开放权重与美国AI领导力》,力挺开放权重模型。两天后 (北京时间7月27日晚) ,Kimi K3完整权重正式开源。 涨价、半价推新、挺开源,三件事方向不同,却共同指向一个判断: 大模型的价格锚正在移位。 开源模型能力逼近闭源后,客户手里有了“可换”的选项,“谁强谁贵”的旧逻辑松动。 接下来的问题是,新的定价逻辑是否合理,能否全行业适用?更重要的是,定价逻辑改变后,估值将如何重构? “替代成本”是新锚 Kimi K3恰好提供了四组证据,每一组都在印证“替代成本”的一个维度:能力价值、替代品价格、切换成本、总体拥有成本。 一是,能力价值是定价的起点。K3编程性能与Anthropic 旗舰Fable 5接近,这是其涨价底气; 二是,替代品价格压低了心理价位。K3定价不足Fable 5的一半,在客户心里画了一条参照线。 三是,开源降低了切换成本; 四是,需要看 总体拥有成本。因为“权重免费不等于使用免费” ,且对部分企业而言,自部署的隐性成本 (推理硬件、集群通信、运维、故障兜底等) 可能远高于API调用费。这正是Kimi开源后,即便降低了客户向外迁移的技术门槛,其原有客户仍会继续存续的关键支撑。 与此同时,API服务在48小时逼近算力极限,官方被迫暂停C端新用户订阅,也初步验证了用户对"省心溢价"的认可 (后续仍需持续季度跟踪调用量、付费率) 。 (图表来源:妙投制作) 妙投注:这一框架存在边界约束。所谓“高替代成本”指的是“试错代价极高的相对粘性”。合规重审(金融/医疗场景周期以月计)、重测算力(一次数十万)、幻觉商誉这三项隐性成本,构成对年调用千万级以上客户的锁定;长尾与非核心业务企业则没有此护城河,定价权弱。 四大因素综合在一起,指向同一个方向: 模型定价,将取决于客户替代方案的全生命周期成本,不再仅由跑分决定。 顺着这个框架,对比看下两家公司在这两周内的反向动作。 一是,Kimi的“阳谋”:涨价与免费并行,抢全球市场。 7月17日,K3发布,输出定价100元/百万tokens,较K2.6/K2.7上涨超3.5倍,放在全球模型层通缩的大背景下,这是逆行者。但 市场用订单投了票,发布48小时内 用户请求量超预期,逼近现有算力的承载极限。 最后Kimi宣布暂停C端新用户订阅,将算力优先保障已有订阅用户的体验。 与此同时,K3完整权重开源,意味着任何企业都可以免费下载、内部私有化部署。仅当对外提供 MaaS 服务,且滚动12个月集团营收超2000万美元时,触发额外商业条款。 这一动作放在黄仁勋公开信号召“开放权重领导力”的背景下,尤其耐人寻味。这意味着,中美在开源路线上的竞争,或将转向全生命周期成本的定价权争夺。 (图片来源:Kimi官网) 此外,涨价与免费,其实是一套逻辑的两面。 前端以免费权重做“销售漏斗”,借企业接入业务流锁定数据迁移与运维需求;后端API涨价仍被买单,证明客户愿为免运维的便利性付费。Kimi以此实现“抢地盘”与“赚利润”的统一。 但隐患在于,开源在加速渗透的同时,也向云厂商敞开了托管服务的大门。Kimi当前API涨价赚取的“省心溢价”,未来可能会面临AWS、Azure等第三方托管服务的价格竞争。护城河不在于开源本身,更关键的是推理优化与服务粘性,能不能持续领先。 与Kimi主动出击形成对照的,是Anthropic在过去一周的被动反应。 二是Anthropic或要“妥协”:半价推新,自拆价格锚。 北京时间6月10日,其旗舰产品Fable 5以"史上最贵通用模型"锚定行业价格天花板。 但7月25日,Anthropic自己拔掉了这根锚,发布性能接近Fable 5的新产品Opus 5,定价仅后者一半。Opus 5还推出了Fast Mode版本,定价10/50美元,等于Fable 5原价,是为愿意“付溢价换速度”的客户保留的分层定价选项。 只不过,整体价格中枢还是下移了。 K3发布后,伯恩斯坦2026-07-17快评指出其定价较 Fable 5 低约 70%,前沿模型能力趋同,将对闭源厂商利润率构成方向性压制。 (Robin Zhu 等,二级转引标题《Kimi K3: A Home Run for China AI》) 关键在于,Anthropic不可能一周内临时打造新品来回应K3,Opus 5的分层策略大概率早已排定。更合理的推演是:K3的发布,迫使Anthropic在最后阶段把价格贴得更低。在推理成本下降、产品线梳理及OpenAI/Google竞争的多重驱动下,K3成为了促使这些因素集中显现的最新变量。 一上一下,殊途同归。 旧锚是“谁强谁贵” ,新锚“谁难替代谁贵”。 Kimi涨价,能力更强只是前提。真正撑住价格的,是帮客户省掉了自己部署的麻烦,即算力、运维、工程门槛,全都不用自己管。 Anthropic半价推新,表面看是被开源逼近了能力,但真正的原因在于:当开源模型能力趋近后,客户换掉它的成本变低了。 换句话说,大模型行业的竞争,正在从“谁的模型能力更强”,转向“谁更难被客户替换”。 而这一转移,将驱动产业链利润池的重新分配,估值逻辑也会跟着被重写。 产业链利润如何分配? 基于当前可观察的产业趋势推演,妙投认为,传导链条分三步。 模型层通缩 (K3开源重构了市场对闭源旗舰的定价参照,Anthropic半价推新则验证了这一趋势变化,API价格中枢在下移) →需求激活 (单位智能变便宜,总消耗量不降反升,K3被抢到算力极限说明瓶颈在供给,而非需求) →利润再分配。 从此推演维度看,算力吃"量"、云厂商吃"托管"、应用吃"价差"、模型争"替代成本"。 (图表:妙投制作) 关键是,替代成本最终属于谁?拆开来看就知道了。 替代成本里,有一部分跟特定模型绑得很死。比如 更换模型造成的能力损失、原厂特有的推理效率,以及绑定该模型的合规认证和工程适配。这部分更可能由模型厂商占有。 一部分跟模型身份关系不大。比如企业私有知识库、Agent 编排框架、内部业务流、统一 API 网关,这部分粘性归云平台、AI 应用厂或客户自身,切换底层模型未必需要重构业务系统。 所以判断模型厂是否真有定价权,不能看"客户整体迁移多贵",关键要看迁移成本中有多少比例随"换掉这家模型"一起消失。这个比例没法直接看到, 但最终会通过续约率、API毛利率与自由现金流来兑现。 如果绑定程度高,并能持续转化为高续约率与高毛利,模型厂商就握
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱