开发者生态
morning
格洛克4.7
摘要
【HN用户评论摘要】 Apparently Grok 4.7 has 40% more weights than Grok 4.6, but the price ($6 output token, $2 input) is the same.Given that the decrease in their margin and the fact they delayed the release o...
the
Grok
with
and
they
for
benchmarks
this
https
has
2026-09-22
1 阅读
约2分钟阅读
meetpateltech
字号:
【HN用户评论摘要】
显然,Grok 4.7 的权重比 Grok 4.6 多了 40%,但价格(6 美元输出代币,2 美元输入)是相同的。考虑到利润的减少以及他们将 Grok 4.7 的发布推迟了原定日期近两周的事实,XAI 肯定对 4.7 的结果不满意。而 XAI 也等到了传闻中 Opus 5.5 发布的前一天。我认为 Opus 5.5 将会在基准测试中击败 Grok 4.7。但是,我对基准测试持怀疑态度。 Grok 4.5 解决了一些问题
遗憾的是,这种模式带有如此负面的政治包袱。这是我决定不在我的 LLM 基准测试中运行的唯一一个[1].1 - https://bench.killswitch-lang.org
很高兴看到这个版本的节奏不断加快并且质量不断提高。我猜测这些模型基本上仍然是光标团队与他们现在拥有的大量计算集成的结果:我想今年晚些时候,随着团队对更大的训练部署变得更有经验和信心,我们将看到 grok 5 的重大改进。希望有另一种有竞争力的前沿模型!
好在他们使用 5.6 sol 而不是 Astra 进行基准测试,EEbench 太疯狂了[1][1]https://eebench.org/
甚至还没有接近阿斯特拉。阿斯特拉是另一回事。它很昂贵,但在完成我的任务时使用的代币更少。xAI 错过了机会,Ball 站在了 Anthropic 的法庭上。
原始链接:https://x.ai/news/grok-4-7
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱