Gemini 3.8 Live 与 Gemini 3.8 Live 扩展思维正式发布,Google DeepMind 称其为目前最先进的实时对话模型。两款模型在智能水平与并行推理能力上均有重大升级,可以更直观地配合用户的语音交流,并执行复杂任务。
姆·乌扬

主任工程师
马里尼·贾纳森
代表 Gemini 音频团队的技术人员
更快、更流畅的语音交互
Gemini 3.8 Live 面向快速、流畅的日常对话场景,支持实时视觉理解与自然的多语言表达。用户在对话过程中可以自然打断,也可以在同一对话中自由切换语言,无需刻意调整交互方式。
复杂任务与扩展思维
Gemini 3.8 Live 扩展思维面向更复杂的任务场景。模型在处理深度推理时能够保持对话的连续性,并在工作过程中向用户解释其推理过程。同时,两款模型均支持在后台执行任务、管理工具调用,用户无需等待任务完成即可继续对话。
可用渠道
- Gemini API
- Google Workspace
- Gemini 应用
- Google 搜索
新模型带来的核心变化在于交互方式:语音对话可以容纳打断、混用语言与实时视觉上下文,模型则负责在后台协调工具与任务执行。对于开发者与普通用户而言,这将人工智能从单轮指令响应进一步推向持续、双向的对话体验。





