谷歌发布Gemini 3.8 Live系列实时对话模型,支持97种语言切换
谷歌推出Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款实时对话模型,支持97种语言切换。前者面向规模部署与成本优化,后者强化多步推理,在Artificial Analysis语音质量指数以82.6%排名第一。
当地时间9月15日,谷歌正式发布两款实时对话模型——Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智能水平和并行推理能力上实现重大升级,目标是让AI对话更加直观、智能。两款产品均支持97种语言切换。
从定位来看,两款模型面向不同场景。Gemini 3.8 Live侧重对话智能、流畅交流与视觉理解,主要面向规模化部署和成本效率优化;Gemini 3.8 Live Extended Thinking则针对高复杂度任务,强化了多步推理能力,适合对智能水平要求更高的应用。
在基准测试中,Gemini 3.8 Live Extended Thinking表现突出。该模型在Artificial Analysis语音对语音质量指数中以82.6%的总排名位列第一;在τ-Voice智能体任务完成率达到68.6%,在Sierra的τ-Voice-banking基准测试中达到35.1%;推理能力方面,Big Bench Audio得分97.7%,同时仍保持有竞争力的定价。
Gemini 3.8 Live同样获得用户较高认可,在Speech Agent Arena中排名第二,并具备出色的成本优势。两款模型的推出,意味着谷歌在实时语音对话与智能体任务领域进一步细化了产品矩阵,分别覆盖成本敏感型部署和复杂推理需求。