开发者生态
morning
涨价30倍仍是最便宜的模型,DeepSeek可能有这个底气
摘要
第三方平台OpenCode工程师 dax 近日发帖讨论了DeepSeek 即将涨价的事,他表示找到了即便是租赁 GPU,也能够复现其当前价格的方法。并且,他推测这次涨价很可能并不是因为 DeepSeek 现在“亏钱”,而更像是一种流量调控手段,因为当前服务负载已经过高,他们希望通过提高价格来压低需求、缓解过载。” Dax 的猜测与很多网友感受一致。“这波主要还是 V4 Flash 整体性价比过于爆...
DeepSeek
Flash
Claude
dax
GPU
OpenCode
API
Token
第三方平台OpenCode工程师
近日发帖讨论了DeepSeek
2026-08-10
1 阅读
约10分钟阅读
褚杏娟
字号:
第三方平台OpenCode工程师 dax 近日发帖讨论了DeepSeek 即将涨价的事,他表示找到了即便是租赁 GPU,也能够复现其当前价格的方法。并且,他推测这次涨价很可能并不是因为 DeepSeek 现在“亏钱”,而更像是一种流量调控手段,因为当前服务负载已经过高,他们希望通过提高价格来压低需求、缓解过载。” Dax 的猜测与很多网友感受一致。“这波主要还是 V4 Flash 整体性价比过于爆炸了,导致 0731 以来东大西大两边都在猛蹬,服务器给蹬冒烟了,什么峰谷定价,不存在的好吧,你这边的谷刚好就是那边的峰,24 小时全是高峰。所以大模型领域,高智、低价和服务的稳定性目前来讲还是个不可能三角。”有网友在知乎上说道。 对于OpenCode可以维持DeepSeek当前价格的消息,有网友评价,“如果属实,那会有很大的意义,也会让外界重新审视 DeepSeek 那支一直被认为是‘传奇’的强大基础设施团队。” 随后,dax 透露这并不是他们自己团队复现的,而是与其正在合作的另一支团队做到的。OpenCode目前正在推动通过 OpenCode Go在中国以外的地区使用低价DeepSeek。 第三方Token更便宜,但花的钱仍比官方多 DeepSeek以低价著称,但同一款DeepSeek模型,在第三方平台的价格甚至可能比DeepSeek自己更便宜。 OpenRouter目前列出的DeepSeek V4 Flash 0423供应商数据显示,DeepInfra对该模型的输入和输出价格分别为每百万Token 0.09美元和0.18美元,而DeepSeek官方对应价格为0.14美元和0.28美元。按标价计算,DeepInfra大约只有DeepSeek官方价格的64%,便宜约36%。其他如GMICloud、百度千帆等第三方平台的报价同样低于DeepSeek官方。 价格对比表,来源:OpenRouter 不过需要注意的是,DeepInfra 当前明确标注自己的 V4-Flash 为 FP4,而 DeepSeek 官方开放的模型仓库里包含 BF16、FP8 等,官方 API 究竟采用什么精度、什么推理策略,并没有在价格页中完整公开。 DeepSeek 已经公开 V4-Flash 权重,许可证允许第三方使用、修改、再分发甚至商业销售。因此,第三方厂商实际上并不是像以 0.14美元买 DeepSeek API,再以 0.09美元亏本转卖的方式运营,它们可以直接下载权重,在自己的 GPU 或其他加速器集群上运行模型。 这与闭源的 GPT、Claude 完全不同。第三方要卖 Claude,本质上通常仍然要向 Anthropic、AWS Bedrock 或 Google Vertex 购买 Claude Token。但第三方卖 DeepSeek V4,可以自己生产 Token。 但把价格与官方打平甚至更低后,用户花的钱会更少吗? 以OpenCode Go为例,其定位为面向开放模型的低成本AI编程订阅服务,首月价格5美元,之后为每月10美元,目前可以调用DeepSeek V4 Pro、DeepSeek V4 Flash、GLM-5.2、Kimi K3、MiMo-V2.5、MiniMax M3、Qwen3.8 Max等多款模型。OpenCode官方目前给出的限制为每5小时最多12美元使用额度、每周30美元、每月60美元。官方还表示对于大多数模型,希望通过批量采购和预留GPU容量等方式,让用户以10美元订阅获得最高约6倍的模型使用价值。 正是“10美元换60美元”让不少用户形成了一个直觉:既然OpenCode Go购买模型资源的实际折扣如此高,那么通过Go调用DeepSeek应该明显比直接购买DeepSeek API划算。 但事实并非如此。 一名开发者用真实AI Coding任务做了一次验证。他选取了一个包含100多个代码仓库的代码库,希望模型调查并理解其中某一特定领域的系统知识,然后同时打开两个终端,一个使用OpenCode Go,一个直接连接DeepSeek官方API,两边输入相同Prompt、执行相同代码调查任务。 按照其公布的测试结果,在多个短任务中,OpenCode Go显示的消费金额平均约为官方DeepSeek API的4倍;部分较长会话的差距超过10倍,也有少数任务只有约2倍。 这名开发者表示,他日常开发主要使用Claude和OpenAI订阅服务,每项月支出约100美元。DeepSeek V4发布后,他开始通过官方API把V4 Pro以及部分V4 Flash用于一些规模较小的代码调查、可观测性分析以及需要快速获得结果的任务,先让DeepSeek搜索代码、读取文件、梳理问题,得到满意结果后再生成笔记,随后把这些结果交给Claude或GPT完成正式开发。按照他的使用方式,即便进行大量工作,一个月的DeepSeek API支出仍然可以控制在10美元以内。 不过有网友指出,OpenCode Go界面里的“美元”与用户钱包里的美元,并不能直接画等号。其认为,Go 本质上是一个固定月费换取内部使用额度的订阅套餐,如果用户每月实际只支付10美元,那么界面显示消耗了数美元模型额度,并不意味着用户真的又支付了这笔钱。因此,将OpenCode显示的8美元额度消耗与DeepSeek API实际扣除的2美元直接比较,很可能夸大OpenCode Go的真实现金成本。但官方更便宜,确实是很多开发者的实际感受。 DeepSeek的低价护城河 “主要差异似乎出在缓存命中率上。”该开发者表示,“DeepSeek 官方 API 在缓存处理方面明显比 OpenCode Go 更好。会话持续得越久,OpenCode Go 累积的缓存未命中似乎就越多,最终成本被放大的倍数也会越来越高。” 最终他得出结论:对于短任务来说,OpenCode Go 可能依然很方便。但如果是更长的会话,尤其是多轮交互累计的模型运行时间超过大约5分钟,那么通过 OpenCode Go 使用 DeepSeek,最终支付的成本可能会明显高于直接调用官方 API。 该开发者还提到了一个细节:使用 GLM 时,他可以通过模型专属设置提高缓存命中率,这类设置有点类似于配置 temperature 或其他请求参数。具体来说,可以设置模型不要重写之前的消息,也不要删除前几轮中的推理内容。但是,OpenCode 并没有为 DeepSeek 暴露类似的模型设置。 对于Coding Agent,模型需要不断读取代码、调用工具、返回结果,然后将已经积累的大量上下文再次带入下一轮推理。如果历史Prompt能够被缓存,后续请求中的大量重复上下文就可以按照极低的Cache Hit价格计费;一旦Prompt前缀发生变化导致缓存失效,几十万甚至更多历史Token就可能重新按照普通输入价格处理。随着会话越来越长,这种差异会迅速放大。 这也是为什么现在单以“每百万Token多少钱”来衡量成本高低,正在变得越来越不准确。 在上面价格对比表中,真正值得注意的是 DeepSeek 官方的“0.0028 美元缓存价”,这是列表中的最低价格。如果能做到95%、99%的缓存命中,DeepSeek官方的 0.0028美元几乎
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱