讯飞开源星火X2.5-4B/1.7B:端侧首个原生100万Token上下文
发布日期:2026-09-01
事件概述
9月1日,科大讯飞全资子公司词元星火推出并开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,两款模型把百万级信息处理能力带到本地设备,采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力做优化。
核心要点
- 上下文:原生支持最长100万Token,主流开源小模型的原始窗口普遍在32K-256K,属数量级差异
- 架构:混合注意力,模型权重、代码仓库与部署文档同步开放,Apache-2.0许可
- 能力:重点强化代码、智能体与指令遵循,4B版本在代码补全与生成上可对标参数规模大2至3倍的云端模型
- 适配:支持英伟达、华为、海光、后摩等多类硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架
- 训练:基于全国产算力平台完成全流程训练,预训练约20万亿Token
行业意义
端侧模型过去受限于上下文窗口,处理完整产品手册或代码仓库时要切段提问,容易忘记前情、遗漏跨章节条件。把百万级上下文放到本地,意味着小模型第一次有了"看完再判断"的依据。