智能AI
evening
DeepSeek 测试其更便宜的 Flash 型号是否可以取代 Pro
摘要
NextFin News — DeepSeek has put its own pricing ladder under pressure. The company opened a limited internal test of an intermediate V4.1 Flash checkpoint and, in the accompanying feedback form, asked...
the
and
Flash
The
that
for
model
rates
peak
yuan
2026-09-09
1 阅读
约4分钟阅读
Chelsea_Sun
字号:
NextFin 新闻 — DeepSeek 已将自己的定价阶梯置于压力之下。该公司开启了V4.1 Flash中级检查点的有限内部测试,并在随附的反馈表中询问参与者新型号是否可以全面取代现役的V4 Pro。该测试版本的模型名称将于 9 月 10 日到期,据称使用了新的结构,添加了本机多模式支持,并相对于之前的 Flash 版本改进了功能、速度和成本。试用期间,其计费费率与现有 V4 Flash 相同,并且每个帐户最多可处理 20 个并发请求。早期的开发人员报告强调编码和检索任务的生成速度明显更高。几乎同时,DeepSeek宣布北京时间9月10日中午Flash系列价格下调。非高峰费率调整至缓存命中输入每百万代币0.02元,缓存未命中输入1元,输出4元;高峰费率仍是非高峰水平的两倍。缓存命中输入的最大减少量达到 60%。该剪切适用于主要 Flash 模型和视觉实验变体。 Flash 和 Pro 之间的价格差距一直很大。在之前的峰值价格下,Flash 产出为每百万代币 9 元,而 Pro 的数字要高得多。开发商长期以来一直接受为更困难的情况支付多倍的费用。悬而未决的问题是,更快、更强的闪存是否能够吸收足够的日常和中等复杂性的负载,而更高层是为真正困难的工作而保留的。这个问题映射到 DeepSeek 本身强调的一个概念:智能密度。早期面向推理的版本表明,较长的思维链可以提高解决难题的准确性。后来的技术讨论转向是否可以用更少的代币和更少的挂钟时间获得相同的质量。更快地获得有用答案且中间计算更少的模型可以改善用户体验和单位经济效益。座席工作量使经济变得更加清晰。当系统读取文件、调用工具、检查中间结果并继续时,单个用户请求可以触发许多模型调用。如果步骤数量成倍增加,较低的每个代币价格不会自动产生较低的任务成本。因此,让模型发出更长的工具使用程序、保留跨步骤的相关推理并避免重新处理已经检查过的材料的框架变得与模型权重本身一样重要。 DeepSeek 的开放 Harness 工作位于这一层:模型决定,harness 提供工具、会话状态和执行环境。其他前沿实验室也出现了类似的重新校准。当中端型号以一小部分成本接近之前旗舰产品的实际性能时,更高级别的型号必须通过用户愿意等待和付费的更长远、更高风险的任务来证明自己的合理性。旗舰模型越来越多地在进行数小时或多天的代理工作以得出可验证结论的能力上进行竞争,而不是在每个单独的基准分数上进行竞争。对于 DeepSeek 来说,近期测试是具体的。如果 V4.1 Flash 中间版本经过完善后,可以处理用户当前转向 Pro 的大部分内容,那么该公司就可以将销量推向更便宜的层,同时将剩余的研究和服务能力集中在更困难的问题上。 V4 堆栈上已经展示了生成速度的改进,再加上较低的闪存价格,强化了同一个方向:使强大的推理变得频繁而不是偶尔。中间检查点是临时的,完全更换的说法尚未得到证实。后续结果将决定有多少 Pro 工作负载可以实际迁移。然而,战略信号已经很明确。在确定强大的推理可以广泛使用之后,下一个竞争轴是智能可以多密集地打包到每一秒的延迟和每个成本单位中。闪存被要求承担更多的负载;亲,如果测试成功,将通过仍然需要它的问题来衡量。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱