首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
汽车 morning

剑指GPT-5.6 Sol,SpaceXAI发布Grok 4.6模型

2026-08-13 1 阅读 约4分钟阅读 IT之家
分享:
字号:
IT之家 8 月 12 日消息,北京时间今天(12 日)晚间,Grok 4.6 正式发布。新模型在 Grok 4.5 基础上进一步强化长时间运行的智能体任务,以及复杂的交互和视觉工作。 按照发布信息,Grok 4.6 能够持续处理包含大量步骤的复杂任务,包括 资料研究、信息分析、大型代码库处理 ,以及将产品构想转化为完整应用或工作成果。 基准测试方面,Grok 4.6 在多项智能体编程和知识工作测试中达到前沿水平。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上, Grok 4.6 与 GPT-5.6 Sol 取得相同成绩 。 据IT之家了解,Grok 4.6 已在 Cursor 和 Grok Build 上线。首周,两项服务将向用户 提供两倍的内含使用额度 。 训练方面,Grok 4.6 经历了 比 Grok 4.5 更长的补充训练 。训练数据包括经过筛选的模型生成推理数据和高级技术概念数据,以及高质量工程数据,并配合改进后的优化器和训练方案,为后续监督微调(SFT)和强化学习(RL)提供基础。 训练团队随后利用 Grok 4.5 重新生成 SFT 轨迹,覆盖不同推理强度、智能体运行框架,以及 STEM、软件工程和知识工作等领域,并使用基于模型的检查剔除存在问题的轨迹。Grok 4.6 还接受了广泛的智能体强化学习训练,任务覆盖知识工作、通用编程、内核优化、Web 开发和计算机辅助设计等领域。 在实际项目测试中,Grok 4.6 重点接受了 长流程、多步骤任务的考验 。测试结果显示,新模型擅长 把宽泛的产品构想转化为可以运行的初版 ,包括研究陌生领域、规划应用结构、实现核心交互,以及根据多轮反馈持续完善结果。 在更长的任务流程中,Grok 4.6 还表现出更多自主测试和验证行为,会在继续执行任务前检查已经完成的工作。视觉和交互式项目的初版成果也较 Grok 4.5 有所提升,面对明确的产品构想时,可以一次建立应用的基本结构和视觉语言。 安全方面,Grok 4.6 根据扩展后的模型能力调整了安全防护机制。此次安全评估覆盖部署前能力测试、安全防护校准,以及部署后和第三方测试,规模为历来最大。安全体系面向漏洞修补、工程设计和 AI 研究等合法使用场景,在提高实用性的同时控制安全风险。 除 Cursor 和 Grok Build 外,Grok 4.6 也已通过 API 开放,并登陆 OpenRouter、Vercel 和 Cloudflare 等合作平台。价格为每 100 万个输入 Token 2 美元 (IT之家注:现汇率约合 13.5 元人民币) 、每 100 万个输出 Token 6 美元 (现汇率约合 40.6 元人民币) ,速度更快的版本价格为普通版本的两倍。首周,Cursor 和 Grok Build 用户可获得两倍的内含使用额度。
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱