快讯 23:57Meta One订阅服务上线,最高月费499美元瞄准AI重度用户23:41Gergely Orosz 探访 OpenAI 总部:Codex 已渗透几乎所有日常工作23:33华为郭平座谈新员工:供应链对标苹果,计算领域瞄准英伟达 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-16 01:05 约 1 分钟读完

Google DeepMind 推出 Gemini 3.8 Live 双模型,加码实时语音智能体

摘要

Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款近实时语音对话模型,前者面向语音智能体场景,后者侧重复杂任务执行,进一步扩展 Gemini 在实时交互方向的产品矩阵。

Google DeepMind 在语音交互方向再度落子。该团队正式推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款模型,二者均定位为近实时语音对话能力,目标指向语音智能体与复杂任务执行两大应用方向。

从命名与定位看,两款模型共享同一代际的实时语音底座,但在能力侧重上有所区分。Gemini 3.8 Live 主要服务于语音智能体场景,强调对话的即时性与交互流畅度;Gemini 3.8 Live Extended Thinking 则在此之上引入扩展思考机制,面向需要多步推理与任务编排的复杂场景。

此次发布延续了 Gemini 系列在实时多模态交互上的推进节奏。将「Live」与「Extended Thinking」两条路线并行发布,意味着 Google DeepMind 试图同时覆盖轻量级实时对话与高负载任务执行两类需求,而非以单一模型通吃。

对开发者与 AI 从业者而言,两款模型的落地价值取决于其在真实语音链路中的延迟表现与任务完成度。近实时语音对话长期受制于响应时延与上下文保持能力,扩展思考机制的引入能否在语音场景下兼顾推理深度与交互节奏,将是后续观察的重点。

Google DeepMindGemini语音模型智能体
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
4
完整版提示词