阶跃星辰发布StepAudio 3系列,五款语音模型一次补齐能力栈
发布日期:2026-09-17
事件概述
2026年9月15日,阶跃星辰发布新一代语音大模型 StepAudio 3 系列,包含 StepAudio 3 Realtime、ASR、TTS、Gen 与 Music 五款模型,覆盖真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解与音乐创作。
核心要点
- 一次覆盖全链路:识别、合成、实时交互与音乐创作在同一系列内补齐,而非逐个发布单点模型
- 已上开放平台:五款模型已在阶跃星辰开放平台上线,开发者可直接调用
- 榜单表现:发布方称多款模型在 Artificial Analysis 相关榜单取得全球第一
- 同日正面竞争:与 Google 当天发布的 Gemini 3.8 Live 形成同一天、同一赛道的正面对撞
行业意义
语音被普遍视为 Agent 与人类交互的核心入口;以系列化方案补齐语音能力栈,意味着语音正在从单点模型变成可交付的能力层。
来源:每日经济新闻