首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

刚刚,DeepSeek V4.1开启测试

2026-09-09 1 阅读 约5分钟阅读 机器之心
分享:
字号:
机器之心编辑部 9 月的大模型会战,DeepSeek 应战了。 今天下午 3 点,DeepSeek 官方社区突然传来消息,DeepSeek V4.1 Flash 直接开始测试。 说是内测,不过对于使用 API 服务的用户来说,没有什么特殊的限制门槛,在现有 DeepSeek 服务商下 手动添加模型:deepseek-v4.1-flash-expires-on-0910,保留原来的 API Key 和 base_url,再在新对话中选择它,就能直接用了 。 最近,「不加班」的 DeepSeek 也被全球的大模型浪潮裹挟着猛猛上新。此前 7 月底上线的 DeepSeek V4-Flash-0731 保持了原有模型结构,仅重新进行了后训练就取得了能力的大幅提升;8 月 13 日,DeepSeek V4 Pro 正式版与 DeepSeek Harness 共同问世,开始尝试通过布局生态来实现能力的最大化;8 月 21 日公开的 deepseek-v4-flash-vision-exp 则支持图文混合输入,结束了 DeepSeek 大模型没法看的历史。 值得注意的是,这次 V4.1 Flash 并不是一次简单的后训练更新。 V4-Flash-Vision-Exp 的一个官方示例:在 Agent 框架下生成商业定制西藏自驾游 PPT。 DeepSeek 明确提到 V4.1 Flash 使用了「新的模型结构」 ,不免让人有了更多期待。 目前因为只是内测,官方给出的信息不多。看起来,官方宣称的新结构虽然不至于是对于模型架构的推翻,但可改的还有注意力机制、专家网络、视觉模块等等。不过既然有了「原生多模态」,我们可以期待像之前 v4-flash-vision-exp 那样,新模型能在大部分任务能力上都有进一步的提升。 另一部分有趣的在于「速度更快」,社区里有人已经获得了 400 token/s 的水平,比 Gemini 3.8 Flash 还要快。 还有用户给出了更直观的对比:在相同任务下,V4.1 Flash 相比 V4-Flash-Vision-Exp,49k 长上下文检索快 5.2 倍、SVG 代码生成快 6 倍。 网友自测显示,V4.1 Flash 在长上下文检索、代码生成、算法题等任务中的端到端速度较 V4-Flash-Vision-Exp 提升约 3.9~6 倍。图源:X 用户 @NFT_Chen。 最后是 「成本更低」 ,虽然当前计费与 V4 Flash 相同,已经有很多人开始期待 DeepSeek 的降价,那个斩杀线又要来了? 我们也在第一时间进行了实测,做一个 html 版本的马里奥 MVP 小游戏,耗时 7 多分钟,成本不到 2 块钱。 它把「立即能玩」作为首要目标,没有一上来就堆很多敌人和关卡,而是先保证「马里奥小游戏」最基本的细节: 金币、蘑菇怪、水管几乎 100% 还原。 再做一个 html 版本的关于 FDE 的科普 PPT,它没有上来就做,而是问清楚是哪个 FDE,以及这个 PPT 是讲给谁听。 接着上网查最新资料,确定大纲先讲什么后讲什么,然后把内容翻译成小白也能听得懂,最终整理成 html。 最后,既然模型名字是 「9 月 10 日到期」( expires-on-0910 ), 这可能意味着该版本还有不到 2 天就会正式失效, 你用上了吗?评论说说你的体验。 © THE END 转载请联系本公众号获得授权 投稿或寻求报道:liyazhou@jiqizhixin.com 平台地址: http://www.jintiankansha.me/t/zx5wZBuavL
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱