智能AI
morning
端侧首个百万上下文!科大讯飞星火X2.5-4B、1.7B开源:全国产算力平台训练
摘要
快科技9月1日消息,今日, 科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,这也是端侧模型中首个原生支持最长100万Token上下文的产品。 两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化,综合实测相关能力领先业界同尺寸一流开源模型。 上下文方面, 星火X2.5-4B和1.7B使用覆盖长篇文档、技术资料等场景的千...
星火X2
4B和1
快科技9月1日消息
科大讯飞全资子公司词元星火正式推出并开源星火X2
4B和星火X2
7B两款端侧通用大模型
这也是端侧模型中首个原生支持最长100万Token上下文的产品
两款模型采用混合注意力架构
围绕智能体
数学和指令遵循等核心能力进行优化
2026-09-01
1 阅读
约3分钟阅读
黑白
字号:
快科技9月1日消息,今日, 科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,这也是端侧模型中首个原生支持最长100万Token上下文的产品。 两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化,综合实测相关能力领先业界同尺寸一流开源模型。 上下文方面, 星火X2.5-4B和1.7B使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据训练,原生支持100万Token上下文窗口, 可以在一次任务中接收和理解更大规模的信息。 百万级上下文真正解决的问题是让模型基于完整信息,在连续交互中持续理解和处理复杂问题。 以产品售后为例,用户可将完整售后手册导入星火X2.5-4B,模型先梳理不同场景下的售后规则并标注对应章节,当被问及“购买10天后设备故障且使用过第三方耗材是否符合换货要求”时,能够关联退换货、故障处理和例外条件等跨章节规定给出综合判断。 面对偏远地区、设备存有家庭地图等新增条件,模型还能保持前文情境,结合物流、数据清除、费用承担和处理时限等规则提供后续建议。 长上下文解决的是信息能不能看全,智能体和工具调用能力解决的则是看完之后能不能动手, 星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。 比如在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中可对标参数规模大2至3倍的云端模型,代码编写、脚本生成和调试辅助工作可以不出本地直接完成。 智能硬件场景中,在Domux智能家居测试集上,星火X2.5-1.7B控制指令端到端执行正确率达到90.3%,平均响应时间仅0.85秒。 机器人场景方面,两款模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。 星火X2.5-4B和1.7B均基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升推理、代码、智能体和指令遵循等任务表现。 部署层面支持NVIDIA、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。 即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应模型API已上线讯飞星辰MaaS平台,限时免费。 此外在9月7日,科大讯飞还将正式发布全新一代旗舰通用大模型星火X2.5,进一步升级代码和智能体等核心能力。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱