Gemini 3.8 Live 引入自定义化身与多语言自动切换功能
- Gemini 3.8 Live 新增自定义化身,可与人工智能声音配合使用。
- 该功能主要面向客户服务、员工培训等场景。
- 模型支持97种语言及自动语言切换能力。
Google 近期更新了 Gemini 3.8 Live,正式开放了用户可选择的虚拟化身功能。这一更新依托于 Gemini 的实时语音交互能力及低延迟视频生成技术,旨在为人工智能赋予更直观的“视觉存在”。

据研究科学家 Shuo-yiin Chang 和软件工程师 CJ Zheng 介绍,尽管目前化身的选择范围尚有限,但 Google 强调其核心价值在于展示最终用户的应用潜力。具体而言,这些数字人形象可被部署于客户服务代表、前台接待以及内部培训助手等角色中。在功能上线初期,企业用户将从预设的化身库中进行选择。
安全机制与性能基准
在内容安全方面,Google 表示所有生成的化身视频均嵌入了 SynthID 水印。该公司指出:“这种不可察觉的水印直接嵌入到音频和视频输出中,有助于确保人工智能生成的内容仍然可检测,以帮助最大限度地减少错误信息和错误归因。”
此外,Gemini 3.8 Live 的多语言能力得到显著增强,现已支持97种语言并具备自动切换功能,从而提升跨语言对话的流畅度。在性能对比上,该模型的进阶版本 Gemini 3.8 Live Extended Thinking 在多项基准测试中表现优于 GPT-Live-1 Astra 和 Grok Voice Think Fast 2.0,同时保持了更具竞争力的每小时输入音频运行成本。





