模型排行榜

DeepSeek发布V4.1-Flash,CED新架构支持百万token上下文

发布日期:2026-09-21

事件概述

DeepSeek 发布 DeepSeek-V4.1-Flash,采用全新的"因果编码器-解码器"(CED)架构,具备多模态理解能力,支持百万 token 上下文,并同步开放 API 与模型权重。

核心要点

  • 参数规格:主干参数5520亿,预填充与解码阶段每token分别激活80亿、160亿参数
  • 缓存优化:结合跨层缓存共享、索引复用与FP4量化,全局KV Cache降至上一代约四分之一,HBM需求降至四分之一、SSD需求降至八分之一
  • 能力表现:最高思考强度下 Terminal-Bench 2.1 达到90.6分,DeepSWE v1.1 达到74.2分
  • 模型下线:官方称各项指标已全面超越 V4-Pro,计划有序下线 V4 Pro,过渡期内仍维持服务

行业意义

长上下文与智能体场景的推理开销正从模型规模转向缓存与存储层级设计,高性价比路线把企业级智能体的落地成本门槛继续压低。

来源:中信证券

本站声明