模型排行榜

讯飞开源星火X2.5-4B/1.7B:端侧首个原生100万Token上下文

发布日期:2026-09-01

事件概述

9月1日,科大讯飞全资子公司词元星火推出并开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,两款模型把百万级信息处理能力带到本地设备,采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力做优化。

核心要点

  • 上下文:原生支持最长100万Token,主流开源小模型的原始窗口普遍在32K-256K,属数量级差异
  • 架构:混合注意力,模型权重、代码仓库与部署文档同步开放,Apache-2.0许可
  • 能力:重点强化代码、智能体与指令遵循,4B版本在代码补全与生成上可对标参数规模大2至3倍的云端模型
  • 适配:支持英伟达、华为、海光、后摩等多类硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架
  • 训练:基于全国产算力平台完成全流程训练,预训练约20万亿Token

行业意义

端侧模型过去受限于上下文窗口,处理完整产品手册或代码仓库时要切段提问,容易忘记前情、遗漏跨章节条件。把百万级上下文放到本地,意味着小模型第一次有了"看完再判断"的依据。

来源:经济日报 · 端侧首个支持百万上下文模型开源

本站声明