模型排行榜

阿里发布Qwen3.8-Omni-Flash,百万token输入低至0.8元

发布日期:2026-09-21

事件概述

2026年9月18日,阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文字、图片、音频和视频,支持100万 token 上下文窗口。

核心要点

  • 能力提升:在约30项评测中较上一代 Qwen3.5-Omni-Plus 平均提升超过25%,音频多说话人识别错误率由88.11%降至3.35%
  • 音视频理解:长音视频任务中 OmniVideoBench 准确率由63.4提升至67.8,token 消耗减少约45.7%
  • 价格:图文音视频输入价格低至每百万 token 0.8元,音频输入成本降幅超过98%
  • 配套工具:Qwen-MM-Plugins 提供 Video2Note 与 Omni Skill Creator,可把长视频整理成图文笔记,或从操作演示中提炼可复用的智能体技能

行业意义

音视频输入的价格门槛被显著拉低,此前因成本被排除在外的实时音视频流水线重新具备可行性,多模态竞争的重心从"能识别"转向"能直接进流程"。

来源:搜狐科技

本站声明