开发者生态
morning
加速 GPT-5.6 Sol 超快
摘要
Aug 13 2026 Accelerating GPT-5.6 Sol Ultrafast Joyce Er Today, Cerebras and OpenAI are sharing an early look at Ultrafast Mode , a new service tier launching first in the OpenAI API and powered by Cer...
and
Ultrafast
Sol
GPT
Cerebras
with
the
mode
intelligence
faster
2026-08-14
1 阅读
约6分钟阅读
pr337h4m
字号:
2026 年 8 月 13 日 加速 GPT-5.6 Sol Ultrafast Joyce Er 今天,Cerebras 和 OpenAI 分享了 Ultrafast Mode 的早期概况,这是一个新的服务层,首先在 OpenAI API 中推出,由 Cerebras 提供支持。 Ultrafast 最初只提供给特定的客户群体,随着时间的推移,访问范围会不断扩大。 Cerebras 在 Ultrafast 模式下为 GPT-5.6 Sol 提供支持,每秒提供高达 750 个输出令牌,并且不会影响任何质量,从而使 Sol Ultrafast 能够加速您对时间最敏感的关键任务工作。以前所未有的速度实现前沿智能人工智能构建者始终需要在速度和智能之间做出选择。随着模型规模和智能的扩大,它们会产生更高的计算和数据移动成本,从而减慢响应时间。用户通常需要等待高质量的结果或在较短的时间内接受较差的结果。 GPT-5.6 Sol Ultrafast 解决了这一问题,为分秒必争的产品和工作流程带来前沿智能。与人工分析报告的输出速度相比,GPT-5.6 Sol 在超快模式下的运行速度比《神鬼寓言 5》快 11 倍,在快速模式下比 Opus 4.8 快 5 倍。在 Cerebras,我们通过与 Humanity's Last Exam 中的流行模型进行正面交锋来测试 Ultrafast。 HLE 是一个具有挑战性的模型基准,由 2,500 个问题组成,通常只有化学、经济学和文学等领域的博士学位人才可以回答。在我们的评估中,超快模式下的 GPT-5.6 Sol 在 11 小时 11 分钟内回答了全部 2,500 个 HLE 问题。 《克劳德寓言 5》需要 78 小时 27 分钟,即三天多的连续计算,才能得出相同的结论。换句话说,Ultrafast 在一个工作日内就突破了人类知识的前沿,达到了近 7 倍的速度。 Humanity 的 Last Exam Benchmark 基准测试由 Cerebras 于 7 月 10 日使用 GPT 5.6 Sol Ultrafast 与 Codex 进行 xhigh 推理,并于 7 月 13 日至 15 日使用 Claude Fable 5 与 Claude Code 进行 xhigh 推理。随着模型能力的不断进步,快速推理的应用范围不断扩大。 GPT-5.6 Sol 是 OpenAI 迄今为止用于法律摘要、财务模型和工程报告的最佳模型。在GDP-Val(具有经济价值的知识工作任务的基准)上,Ultrafast 实现了 5.6 倍的端到端加速,且质量没有下降,这表明更快的推理如何能够加速具有经济价值的工作。 Cerebras 于 2026 年 7 月 31 日使用 GPT 5.6 Sol 和 GPT 5.6 Sol Ultrafast 在 Codex 内的介质推理上进行了基准测试。高速智能为高风险工作提供动力更快的智能改变了个人和组织的可能性。借助 Ultrafast,您现在可以将代理置于分秒必争的问题关键路径上。 “借助 GPT-5.6 Sol Ultrafast,Cerebras 使人工智能能够跟上您的思维、编码和协作方式。我们很高兴看到超快推理如何改变工作流程和应用程序。” OpenAI Ultrafast 的 Rohan Varma 产品是使用前沿人工智能快速响应传入信息的组织的持久优势。运营 Web 服务的公司可以利用 Ultrafast 找出根本原因并解决生产中断问题,维护客户信任,防止收入损失,并根据 SLA 节省停机时间。在对抗性高风险网络攻击中,超快对于安全团队来说是一个宝贵的工具,他们必须快速检测并响应不良行为者以遏制灾难性损失。更广泛地说,Ultrafast 支持与代理合作的全新模式,它提供实时见解和更新,因此您无需在多个并行会话之间进行上下文切换即可充分利用代理。 “以前我可能需要等待几分钟才能完成一项任务,但现在我什至没有机会进行上下文切换,它就已经为我完成了。这让我的工作效率大大提高。” Jeffrey Wang OpenAI 研究员 借助 Ultrafast,研究人员和工程师可以将注意力集中在深入研究最重要的问题上,同时继续使用标准处理来并行化商品任务。 Cerebras 很高兴能够推动下一波人工智能创新浪潮,提高个人和组织通过响应式人工智能实现目标的上限。突破性创新实现极快速度超快模式下的 GPT-5.6 Sol 由 Cerebras 革命性的晶圆级引擎架构提供支持,专为前沿 AI 工作负载而构建。快速前沿推理是一个数据移动问题:在 GPU 上,大型模型的推理受到内存带宽的瓶颈,因为模型权重必须在片上内存和片外存储之间重复传输,以在模型响应中生成连续的令牌。 Cerebras 采用逆向方法来消除这种低效的数据移动:我们在每个晶圆大小的芯片上封装了 44 GB 的 SRAM。权重保留在芯片上,代币不间断地流动
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱