快讯 23:12李楠评锤子TNT生不逢时:Agent时代让当年操作不再困难22:17PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍22:00NVIDIA 联手 Google DeepMind 等开放 2800 余种病毒蛋白复合物预测结构 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期五 · 09-25 08:39 约 1 分钟读完

谷歌 Gemini 3.8 Live 新增虚拟人功能,支持 97 种语言实时唇形同步

摘要

谷歌在 Gemini 3.8 Live 基础上正式推出 Live Avatar 功能,将接近实时的视频生成与语音结合,支持精准唇形同步、自然表情及 97 种语言无缝切换,企业可自定义虚拟形象,目前自定义功能仅对企业白名单用户开放。

谷歌近日宣布,继上周推出 Gemini 3.8 Live 之后,正式为该原生实时对话模型加入 Live Avatar 功能。这一新增能力将接近实时的视频生成与语音技术相融合,使企业智能代理能够以动态视觉形象与用户交流,同时处理视觉和音频输入,生成更丰富的对话体验。

据谷歌介绍,Live Avatar 具备精准的唇形同步、自然表情以及流畅的对话轮次切换能力。该功能支持原生多语言语音同步,可动态适配唇形与表情,在 97 种语言之间无缝切换,且不会降低视频保真度或出现视觉偏移。这意味着企业可以借助单一虚拟人形象覆盖多语言服务场景。

在交互能力之外,Live Avatar 依托 Gemini 的高级推理能力,通过异步工具调用机制在后台触发工具调用并获取数据,同时保持对话正常进行。这一设计旨在处理复杂任务时保证对话流程不中断,提升虚拟服务在任务型场景下的可用性。

企业用户除了可从预设的多样化形象库中选择外,还可通过高质量参考图像生成完整动画、响应灵敏的虚拟形象,并保留参考形象的相似度、品牌风格与角色特征。不过,谷歌表示自定义虚拟形象目前仅对企业白名单用户开放。此外,谷歌为 Live Avatar 构建了严格的安全保障机制。

谷歌Gemini 3.8 Live虚拟人多语言
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
50
企业落地案例
6
完整版提示词