医疗健康
morning
深度|开源大模型的「奥本海默时刻」
2026-08-04
1 阅读
约10分钟阅读
杜晨
字号:
过去几天,DeepSeek 和 Qwen 对大模型行业带来了前所未有的颠覆效果。 Hermes Agent 背后的公司 Nous Research 宣布,刚刚正式推出的 DeepSeek V4 Flash 模型在其平台上启动一折促销,持续 7 天。 这是一个荒诞却又务实的价格,Nous 原话说 DSV4 Flash 的调用成本比 Fable 5 便宜千倍以上。即便回归正价,其性价比依然维持着百倍左右的碾压优势,打不打折都便宜到离谱。 更别提它还是开源的,理论上只需数百 GB 显存/统一内存即可部署量化版本,内存稍多一些甚至可以部署无损版本。比如一台(目前尚无新机可售的) 256/512GB RAM 版本 Mac Studio,或者两台英伟达 DGX Spark 堆叠起来。事实上,DeepSeek 一直是开源模型当中对 准消费级硬件本地部署最友好的, 参见我们的 Mac Studio 部署体验。 如果这对你来说还是太极端,那么云端充个几十块钱 API 也足够用很久了。由于 DSV4 Flash 性价比实在太高,甚至有三方平台免费提供: OpenCode 透露仅在 8 月 1 日这天,DSV4 Flash 就消耗掉了 8 万亿 token,其中包括 5 万亿免费、3 万亿付费额度。OpenCode CEO 发推表示:我觉得大家根本没意识到正在发生什么。 是啊,我们并未清楚地看到什么发生了,却有足够强的感受:一夜之间,好像一切都变了。 1942 年,科学家爱德华·泰勒提出了一种极其微小但并非是 0 的可能性,让全力开动的曼哈顿计划陷入恐惧:核裂变产生的瞬时高温,有可能点燃空气中的氮原子,进而引发一场不可逆的链式反应,摧毁整个地球。 好在,后续的论文和实测打消了这一顾虑,但一直以来对政治颇有兴趣的奥本海默,有着更深层的担忧: 链式反应确实发生了,只是不在大气层里,而是经由 Trinity 试验的成功开启了一个新的核时代,并彻底重塑了人类社会的政治、地缘、工业与文明形态。 此时此刻,恰如彼时彼刻。未来的科技行业又将怎样彻底改写? 价格战的连锁反应 本周正式发布的 Qwen-3.8-Max,展现出与 DeepSeek V4 Flash 类似的「新方向」。 无论是模型创业公司还是互联网巨头,过去发布模型时无一例外将特定任务上的 绝对性能 摆在最醒目的位置。这一次略有不同:Qwen-3.8-Max 拥有强悍的底座,其宣发叙事却向 「性价比」 全面倾斜,与 DeepSeek 遥相呼应。 爱范儿认为,这并非偶然的营销巧合,而是越来越多的模型团队,在同一种行业演进逻辑下不期而遇。 我们采访过许多模型公司/团队负责人,询问开源时代何时终结。每个人都有不同答法,但结论无一不指向 即将到来的价格战。 过去的价格战,例如打车、共享单车、外卖等,大多是资本充沛者通过亏本补贴来强行清场的戏码。但这次模型价格战的底色不同—— 表面上看起来是价格战,底层是一场由算法架构代差,由基础研究和创新能力所驱动的非对称效率战。 DeepSeek 等一众国模敢于将价格砸穿,底层依托的是稀疏激活、注意力机制重构等基础研究和工程层面的创新。中国模型公司和团队们在底层上找到了极度残忍的算力解法,能够用相对更小的参数激活量,榨取出比肩硅谷天量级参数量稠密模型的推理质量。 这种技术路径的突破, 不仅在其他模型厂商的脖子上架上一条「斩杀线」, 更彻底改写 AI 创业公司与互联网巨头大厂的对战规则。 传统移动互联网时代,大厂拥有近乎无限的资金池与云计算基础设施,创业公司难以在价格战中与之抗衡,不陷进泥潭被耗尽现金流。 但是到了 AI 时代,你会发现情况发生了巧妙的逆转:以 DeepSeek、月之暗面等为代表的硬核创业公司,反而获得了极其惊人的爆发力,丝毫不怵价格战(有的甚至逆势涨价)。 这些创业公司的研发组织相对扁平,创新能力更强,内部也极有可能沉淀着并未公开的技术优势。甚至有人开玩笑,DeepSeek 梁文锋肯定还藏着几手,随便使出来就足以让 Fable 和 GPT 更加颜面扫地——只是出于维持中美之间半年到一年差距这一「战略性落后」,绝活不轻易亮出来。 对于这些模型创业公司而言,价格战绝非自残,反而成为了一众高效的增长杠杆。 我们认为逻辑大概是这样的:技术创新降本,砸穿全球底价;Token 调用爆发,ARR 曲线拉升;资本市场追捧,完成更多融资。 说白了,这些模型创业公司越卷价格,用户粘性越高,资金回笼与技术迭代的闭环反而越坚实,飞轮转的越快。 大厂呢?相比之下,他们有更强的路径依赖,也需要贯彻集团的协调意志。面对价格战,大厂惯于依靠自有现金流、云计算业务来硬扛补贴,用庞大的固定资产来组成壁垒。但当创业公司将单位 Token 成本压到史低水平,巨头的补贴思路却更容易让云计算业务乃至集团整体的财报承压。 价格战里,创业公司越卷越舒服,大厂却可能被拖垮业绩。 巨头的围墙内部撕裂也正在悄然发生。表面上看,无论是阿里还是腾讯,都已经明确将大模型以及相关产品定为公司新一号位。组织架构多次调整,财力、人力、算力资源向模型与模型产品部门倾斜,声势浩大。各团队纷纷「赛马」推出竞争产品,僧多肉少。 但在表面之下,这种一号位的资源灌注,大刀阔斧的调整,以及再次热闹起来的「赛马」文化,却让僧多肉少的形势进一步加剧,容易引发剧烈的自我吞噬与组织紊乱。 云计算部门是大厂最核心的现金流支柱,今天最关键的优质客户,恰恰也是风头正劲的 AI 创企。 而当价格战开打,大厂集团层面面临着难以调和的商业悖论:云计算当然希望 DeepSeek、Kimi、智谱们过的越来越好,创业公司用量越大,采购需求就越强;但与此同时,大厂自研模型和模型产品部门,在 C 端和 B 端也在与这些创业公司进行着市场份额的激烈争夺。补贴自家模型和模型产品,代价就是暂时性让财务报表承压。 答案是明确的:一位大厂 CEO 曾表示,当前的任务是以超过行业平均的速度获取市场份额,「利润率是我们的第二目标。」 对于云计算部门,客户是内部还是外部本来没什么关系。但现在他们面临的尴尬处境是,给自研模型和模型产品部门输血,集团层面势必对云计算的商业决策产生干预。 倒不是说云计算行业过去对于公有云的商业与生态中立原则(不与客户争利)有多么看重,至少更务实来讲,云部门与模型部门的共谋行为难免引发外部客户不信任,倒逼创业公司自建云,进而影响大厂云部门的收入。 类似的尴尬,在亚马逊与 Netflix,与沃尔玛、Target 等零售巨头之间都曾发生过。 ——当然,以上都只是基于合理推断的可能性,并未完全真实发生。但当价格战真正开打,在大厂内部,作为现金牛的云计算部门和作为新一号位的模型与模型产品部门,难免陷入互为毒药的僵局。 信息图中资料截止时间:2026 年 5 月底 在现实中,大厂通过投资创业公司完成战略上的对冲。本质上,这种做法让钱从战投的左兜出、云计算的右兜进,云部门赚取了账面收入,战投获得了股权,集团扩展了自己的疆域,画出新的山头。 这难免让自研模型部门暗自不爽,因为他们会发现市场上最猛烈的低价子弹,其实是用自家的钱购买、从自家服务器的枪口里射出来的。 更深层的问题是,在移动互联网时代,巨头投资创业公司能够将其锁进自己的流量
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱