智能AI
morning
DeepSeek官宣即将大幅涨价,服务器终于挤爆?
摘要
机器之心编辑部 顶不住,服务器真的顶不住,DeepSeek 要涨价了。 周四上午,用 DeepSeek API 的同学们都注意到了这样一条公告。DeepSeek 要涨价了,而且预期涨幅会很大。虽然这次官方并未透露具体幅度和生效时间,但已经建议企业与开发者「合理规划请求量、控制充值金额」。 AI 开发者社区里顿时炸开了锅。 长期以来,DeepSeek 凭借超高的 Token 性价比(极低的输入、输出...
DeepSeek
Flash
0731
Pro
API
Agent
要涨价了
Harness
机器之心编辑部
顶不住
2026-08-06
1 阅读
约5分钟阅读
机器之心
字号:
机器之心编辑部 顶不住,服务器真的顶不住,DeepSeek 要涨价了。 周四上午,用 DeepSeek API 的同学们都注意到了这样一条公告。DeepSeek 要涨价了,而且预期涨幅会很大。虽然这次官方并未透露具体幅度和生效时间,但已经建议企业与开发者「合理规划请求量、控制充值金额」。 AI 开发者社区里顿时炸开了锅。 长期以来,DeepSeek 凭借超高的 Token 性价比(极低的输入、输出费用,外加很高的缓存命中率)吸纳了庞大的流量,但与此同时,它也面临着的算力成本压力。随着模型调用量呈指数级暴增,补贴式的低价策略似乎难以为继了。 在上周 DeepSeek V4 Flash 0731 发布以后,大模型拥有了接近于 Opus 4.8 的能力,但同时只有 Fable 5 百分之一的价格。这样的成本,在处理高并发、日常对话、代码辅助与高吞吐检索任务时可以说占尽了优势,很多开发者都在尽情使用。 这个上下文长达 1M,速度还很快的模型几乎「用到就是赚到」,什么活都可以交给它去干,没有任何心理负担。 于是终于再现了去年 DeepSeek R1 时的盛况:本周二,不少开发者反映 DeepSeek V4 Flash API 频繁出现 Server Busy、延迟飙升或短暂停机(Downtime)的情况。就连 APP 端也出现了宕机的情况。 开源的 AI 编程智能体工具 OpenCode 因为套餐里有 DeepSeek 新模型涌进了大量用户,8 月 5 日 V4 Flash 的 token 消耗量已经到了 6.3 万亿。 有关 V4 Flash 0731 的评测已经很多了,像独立 AI 评测平台 Artificial Analysis Intelligence 就更新了一下他们的综合能力图,把知名模型的价格与智力水平都放在一起对比。V4 Flash 0731 在左上的位置:智能水平高,且价格低。 它框出来的右下的那么多模型,都有着落后的危险。 而且现在这还只是个 Flash 版,Pro 版出来预计还会继续缩圈。 如此看来,DeepSeek 似乎确实有涨价的理由。 其实在上个月,DeepSeek 已经预告采取峰谷定价机制,北京时间每日 9:00-12:00、14:00-18:00 高峰期调用价格翻倍。官方可能希望以此引导流量错峰,但这种方式看来依然难以全面平衡服务成本与负载压力,毕竟 V4 Flash 0731 出来以后全球都在用,24 小时都是高峰期。 当然这波涨价预告可能也是新版本发布的一部分。DeepSeek 官方预计于 8 月上旬全面上线 DeepSeek-V4-Pro 的 API 部署。作为拥有 1.6T 深度 MoE 架构(激活参数约 49B)的旗舰模型,Pro 版本在长文本(1M Context)、复杂智能体任务和硬核编程上具备极强实力。 与此同时,围绕 V4 系列模型,官方配套的 DeepSeek Harness 生态也很有可能同时推出。开发者可以通过更精细的 Harness 框架(包含 MCP 服务器、Agent 执行环境及多层 Reasoning Effort 调度),将 V4 Pro 的 Agent 潜能最大化。 虽然 API 涨价在即,但对于需要高性价比大模型、复杂代码生成和 Agent 工作的开发者而言,正式版的 V4 Pro 以及大幅增强的 Flash-0731 依然是开源与商业大模型阵营中极为关键的竞争力量。 © THE END 转载请联系本公众号获得授权 投稿或寻求报道:liyazhou@jiqizhixin.com 文章原文
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱