Google发布Gemini 3.8 Live,边说话边推理并支持97种语言
发布日期:2026-09-17
事件概述
2026年9月15日,Google 正式推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,主打语音智能体与复杂任务执行。前者面向低成本实时交互,后者可在语音交流的同时持续后台推理。
核心要点
- 榜单表现:Extended Thinking 版在 Artificial Analysis 的 Speech-to-Speech Quality Index 中以 82.6 分登顶
- 能力差异:普通版支持 97 种语言自动切换、近实时视觉输入与后台工具调用;Extended Thinking 版面向多步骤复杂任务
- 定价:音频输入每分钟 0.005 美元、输出每分钟 0.018 美元,定价在同档中偏低
- 可追溯性:Google 称音频产物均可被检测,并加入 SynthID 不可见水印
行业意义
语音从「输入方式」变成可并行的任务通道——实时对话与后台推理解耦后,语音智能体的可用性明显提升,内容可追溯性也被同步补上。
来源:果壳