Google发布Gemini 3.8 Live及扩展思维模型

Google DeepMind正式发布Gemini 3.8 Live与Gemini 3.8 Live扩展思维两款模型。前者主打快速流畅的日常语音对话,支持实时视觉理解、自然打断及多语言切换;后者面向复杂任务,具备并行推理能力,可在后台执行工具调用并保持对话连续性。

Gemini 3.8 Live 与 Gemini 3.8 Live 扩展思维正式发布,Google DeepMind 称其为目前最先进的实时对话模型。两款模型在智能水平与并行推理能力上均有重大升级,可以更直观地配合用户的语音交流,并执行复杂任务。


姆·乌扬

支持实时打断与后台并行推理

主任工程师

马里尼·贾纳森

代表 Gemini 音频团队的技术人员


更快、更流畅的语音交互

Gemini 3.8 Live 面向快速、流畅的日常对话场景,支持实时视觉理解与自然的多语言表达。用户在对话过程中可以自然打断,也可以在同一对话中自由切换语言,无需刻意调整交互方式。

复杂任务与扩展思维

Gemini 3.8 Live 扩展思维面向更复杂的任务场景。模型在处理深度推理时能够保持对话的连续性,并在工作过程中向用户解释其推理过程。同时,两款模型均支持在后台执行任务、管理工具调用,用户无需等待任务完成即可继续对话。

可用渠道

  • Gemini API
  • Google Workspace
  • Gemini 应用
  • Google 搜索

新模型带来的核心变化在于交互方式:语音对话可以容纳打断、混用语言与实时视觉上下文,模型则负责在后台协调工具与任务执行。对于开发者与普通用户而言,这将人工智能从单轮指令响应进一步推向持续、双向的对话体验。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读