科大讯飞旗下词元星火于9月1日宣布,开源了星火X2.5-4B与X2.5-1.7B两款端侧通用大模型。这两款模型最大的特点是,原生支持最长100万Token的上下文窗口,声称是目前端侧模型中唯一支持该量级上下文的产品。
两款模型基于全国产算力平台完成全流程训练,使用了约20万亿Token的多样化数据进行预训练,并针对智能体、代码、数学和指令遵循等核心能力进行了优化。百万级的上下文窗口,使得模型能够处理超长的输入信息。
在具体应用验证上,词元星火以产品售后场景为例,用户可将完整售后手册导入模型,针对“购买10天后设备故障且使用过第三方耗材”等复杂问题,模型能够关联跨章节规定给出综合判断。在个人办公场景中,星火X2.5-4B可完成从原始数据分析到双语报告交付的全流程。
模型的实际运行效果也有具体测试数据支撑。在Domux智能家居测试集上,星火X2.5-1.7B的控制指令端到端执行正确率达到了90.3%,平均响应时间为0.85秒。这显示了其在实时交互场景中的实用性。
硬件兼容性方面,星火X2.5系列支持英伟达、华为、海光及后摩等硬件平台。这意味着开发者可以在多种国产及主流硬件上部署和运行这两款模型,降低了端侧AI的部署门槛。
对于端侧设备而言,实现百万级上下文窗口意味着可以在本地处理长文档、长对话,而无需依赖云端,这对于数据隐私敏感或网络条件受限的场景尤为重要。同时,完全基于国产算力训练,也减少了对外部算力的依赖。



