首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于

Quasar 438B:欧洲领先的人工智能模型

2026-09-02 1 阅读 约7分钟阅读 amunozo
分享:
字号:
Quasar 438B 是我们的旗舰推理模型,专为企业级代理和编码而构建。它是 MultiverseComputing 发布的第一个大型模型,以英语和西班牙语运行,在人工智能分析指数上得分为 43,是该领域所有欧洲模型中的最高分。 Intelligence Index v4.1.1 结合了九项评估:GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience 和 AA-LCR。 Quasar 的 43 分领先于 Mistral Medium 3.5(30 分)、NVIDIA Nemotron 3 Ultra(38 分)和 Inkling(42 分),领先于 Claude Opus 5(63 分)。Quasar 不仅智能,而且速度很快。它在 15.3 秒内返回 500 个令牌(包括思考时间)。比较中只有三款型号速度更快,而且只有其中一款(Gemini 3.7 Flash)在该指数上得分更高。在得分超过 Quasar 的模型中,只有两个在 25 秒内给出答案。其余的则在 38 到 156 之间。多元宇宙计算的定位是让人工智能更加高效和可部署。 Quasar 将这项工作引入了 400B+ 参数类:一个用于需要规划、工具使用、代码执行和大上下文的多步骤任务的推理模型,而没有类通常带来的延迟。该模型可通过 CompactifAI API 获取,因此团队无需建立基础设施即可对其进行测试。得分最高的欧洲模型 图 1. 人工分析智能指数 v4.1.1,由九项评估组成。越高越好。 Quasar 的综合指数得分为 43。这比 Mistral Medium 3.5 领先 13 个百分点,比 Nemotron 3 Ultra 领先 5 个百分点,后者多携带 1120 亿个参数。前沿级速度 图 2. 端到端响应时间:输出 500 个令牌的秒数,包括推理时间。越低越好。 Quasar 在 15.3 秒内完成了 500 个令牌的响应。比较中速度更快的三个型号是 Nemotron 3.5 Lightning,速度为 9.4 秒,得分为 24;Gemini 3.5 Flash-Lite,速度为 10.8 秒,得分为 37;Gemini 3.7 Flash 速度为 11.5 秒,得分为 56。只有最后一个速度更快,能力更强。换个角度读,差距就更大了。 Quasar 得分 43,用时 15.3 秒。 Mistral Medium 3.5 得分为 30,耗时 18.8 秒。 Nemotron 3 Ultra 得分为 36,需要 25.7 秒,Inkling 得分为 42,需要 48.3 秒,比 Quasar 438B 多了一倍多。与 Mistral Medium 3.5 的比较在两个轴上都以一种方式进行:Quasar 得分更高(43 对 30)并且回答速度更快(15.3 秒对 18.8 秒)。长上下文推理 图 3. AA-LCR 得分。越高越好。 Quasar 在 AA-LCR 上得分为 75.0,该测试测试了对跨长文档的信息进行提取、连接和推理的能力。这与 Grok 4.6(高)的 75.0 持平,与 Claude Opus 5 的 75.7 和 Qwen3.8 2.4T A95B 的 75.3 相差不远。它领先 Nemotron 3 Ultra 4.0 分,领先 Mistral Medium 3.5 分 9.7 分。长上下文处理是企业研究、文档分析和代理工作流程的基础,也是 Quasar 最接近前沿的地方。代理编码和终端工作 图 4. Terminal-Bench v2.1 得分。越高越好。 Quasar 在 Terminal-Bench v2.1 上得分为 69.3,它使代理可以在真实的终端环境中工作。它领先 Mistral Medium 3.5 18.7 分,领先 Nemotron 3 Ultra 15.4 分,落后于由 Claude Opus 5 领导的前沿组(89.1 分)。这是Quasar最有发展空间的评估,也是下一轮工作的目标。一张视图中的四个结果 表 1. 四张提供的人工分析图上的 Quasar 438B。资料来源:人工分析。专为企业级代理和编码而构建 Quasar 专为运行软件开发代理、技术副驾驶、研究系统和工作流程自动化的组织而构建。终端工作台和长上下文结果支持必须掌握上下文、协调操作并完成多步骤任务的代理。响应时间使这些循环足够快,可以放入交互式产品而不是批处理作业中。对英语和西班牙语的支持使 Quasar 成为欧洲和国际企业的实用基础,这些企业需要推理而不将部署范围缩小到单一语言。团队可以将其应用于工程、运营和知识工作,只要准确性、上下文和可靠的任务完成决定结果。 Quasar 即将推出更多更新。敬请关注。开始使用 CompactifAI API。注册并开始发送请求:dashboard.compactif.ai 人工分析。查看基准测试 联系方式。也可以通过business@multiversecomputing.com 联系我们的团队
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱