Google 近日为其 Gemini 3.8 Live 模型引入了视频交互功能,正式推出“Live Avatar”(实时化身)。这一更新将近乎实时的视觉形象与对话模型相结合,旨在为销售支持和客户服务等场景提供更具沉浸感的交互体验。

此前于上周发布的 Gemini 3.8 Live 及 Live Extended Thinking 模型被 Google 称为其迄今最先进的现场对话系统。新加入的 Live Avatar 功能允许用户通过语音指令执行复杂任务,同时使对话过程更加自然流畅。根据官方描述,该功能创造了一种“动态视觉人物倾听、观察并与用户交谈”的体验。
在展示视频中,Google 演示了写实风格及卡通风格的多种化身形象。公司表示,这些化身能够利用面部表情进行非语言交流,从而实现更自然的多模态对话。得益于 Gemini 先进的推理能力,Live Avatar 可以在维持主动对话的同时,后台触发工具调用并获取数据。
目前,Live Avatar 主要面向 Google 的企业客户开放。企业可以从 Google 提供的预设化身库中进行选择,也可以基于高质量参考图像定制符合自身品牌形象或角色身份的专属化身。此类服务需通过企业许可列表获取。
针对身份尊重与内容透明度的问题,Google 强调 Live Avatar 配备了严格的保护措施。所有由该功能生成的内容均嵌入 Google 的 SynthID 水印技术,以确保人工智能生成内容的可识别性。随着技术的普及,用户未来可能在电脑或移动设备屏幕上频繁接触到此类用于客服或销售的人工智能化身。





