Google DeepMind 推出 Gemini 3.8 Live 双模型,加码实时语音智能体
摘要
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款近实时语音对话模型,前者面向语音智能体场景,后者侧重复杂任务执行,进一步扩展 Gemini 在实时交互方向的产品矩阵。
Google DeepMind 在语音交互方向再度落子。该团队正式推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款模型,二者均定位为近实时语音对话能力,目标指向语音智能体与复杂任务执行两大应用方向。
从命名与定位看,两款模型共享同一代际的实时语音底座,但在能力侧重上有所区分。Gemini 3.8 Live 主要服务于语音智能体场景,强调对话的即时性与交互流畅度;Gemini 3.8 Live Extended Thinking 则在此之上引入扩展思考机制,面向需要多步推理与任务编排的复杂场景。
此次发布延续了 Gemini 系列在实时多模态交互上的推进节奏。将「Live」与「Extended Thinking」两条路线并行发布,意味着 Google DeepMind 试图同时覆盖轻量级实时对话与高负载任务执行两类需求,而非以单一模型通吃。
对开发者与 AI 从业者而言,两款模型的落地价值取决于其在真实语音链路中的延迟表现与任务完成度。近实时语音对话长期受制于响应时延与上下文保持能力,扩展思考机制的引入能否在语音场景下兼顾推理深度与交互节奏,将是后续观察的重点。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗