首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于

K2 Horizo​​n:前沿性能,彻底开放

2026-09-04 1 阅读 约5分钟阅读 karimf
分享:
字号:
今天,IFM 发布了 K2 Horizo​​n,这是一个由六种型号组成的互联车队:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B。在推理、数学、编码、代理任务和一般功能方面,K2 Horizo​​n 在每个尺寸类别中均提供顶级性能,其中 0.9B、3.7B 和 7B 模型在各自的尺寸上树立了新的技术水平。 K2 Horizo​​n 也是我们迄今为止最全面的开放版本。对于每个模型,我们都开放从预训练到推理和代理后训练的训练生命周期。我们正在发布中间检查点、训练数据或详细的数据构建方案、开放架构、混合组合、训练代码、配置、细粒度日志、评估结果和最终权重。模型和代码在 Apache 2.0 许可证下发布。数据集根据其适用的许可证发布,例如 ODC-BY;我们公开了当无法重新分配时如何构建和混合数据。 K2 Horizo​​n 代表了迄今为止最全面的开放模型版本:跨尺度的新性能前沿。在广泛使用的评估中,0.9B、3.7B 和 7B 型号在其尺寸类别中实现了世界领先的性能。 36B-A4B 模型配备了我们新的价值注意力混合 (MoVA) 机制,为每个活动参数提供了卓越的功能,优于一些更大的模型。 32B 和 375B-A23B 型号在各自级别中名列前茅。这六种模型共同提供了从边缘设备到企业的跨部署环境的竞争性能。第一个对代理商完全开放的模型车队。 K2 Horizo​​n 是第一个通过代理后训练公开完整开发过程的开放模型系列。通过在每个阶段发布检查点、数据(或数据配方)、代码、配置和训练日志,K2 Horizo​​n 使研究推理、工具使用、规划和代理能力如何出现成为可能;重现创建它们的方法;并使这些方法适应新的工具、环境和领域。跨越边缘到企业的六种模型。 0.9B 型号专为手表和眼镜等高度受限的环境而设计,而 3.7B 和 7B 型号则为手机和其他设备上应用程序带来了先进的功能。密集的 32B 模型和稀疏的 36B-A4B 模型为本地工作站和高效服务提供了强大的选项。 375B-A23B 型号为要求严苛的企业部署带来了最强大的功能。所有六个模型都包含量化支持。一支互联舰队。这六个模型共享核心架构、词汇、训练方法、接口、评估基础设施和部署工具,0.9B 模型的词汇量较小。这种一致性还使得在不同规模之间移动、动态安排工作以及跨规模研究能力和效率变得更加容易。各个维度的世界领先性能 0.9B、3.7B 和 7B 模型在数学、推理、一般能力、编码和代理任务方面在各自的类别中取得了最先进的结果。 36B-A4B 模型的性能超出了其活动参数计数通常预期的水平,证明了我们独特的专家混合设计在计算注意力值时的效率。 32B 和 375B-A23B 型号在各自的比较类别中属于顶级型号。小型号尤其引人注目。 K2 Horizo​​n 0.9B 的 AIME 2026 得分超过 48 分,并具有强大的推理、工具使用和代理能力。 K2 Horizo​​n 3.7B 和 7B 将这些功能扩展到要求更高的软件工程和多步骤环境,并在 SWE-bench 和 BrowseComp 中展示了强大的性能。尽管需要大量探索和重复恢复的复杂任务(例如 TerminalBench 中的任务)对于最小的模型来说仍然很困难,但 K2 Horizo​​n 突破了各种规模的可能性边界。为什么地平线舰队很重要 远远落后于能力前沿的透明模型作为基础的价值有限,即使对于研究也是如此。与此同时,一个仅作为最终权重发布的强大模型允许人们运行它,但很少深入了解其功能是如何创建的。 K2 Horizo​​n 将这两者结合在一起。该车队提供极具竞争力的模型,并发布用于训练它们的配方。研究人员可以研究足够强大的模型中的高级功能来展示它们,而开发人员可以复制、调整和扩展这些方法,而不是将最终检查点视为不透明的起点。自从我们在 2023 年 LLM360 论文中引入完全开放原则以来,我们每年都会发布开放模型,同时将这一承诺扩展到更大的规模、更强的功能,以及现在通过代理后训练的完整生命周期。对于每个 Horizo​​n 模型,我们将发布: 训练数据或配方,例如构建方法和 mixtu
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱