Google 发布 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 以提升 AI 对话体验

·作者 Henderson·Gemini
Google 发布 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 以提升 AI 对话体验

Google 今日宣布推出 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking,称其为“最先进的实时对话模型”。继 3.1 Flash Live 于三月推出后,这些新模型旨在使与人工智能的对话更具直观性和智能性。顾名思义,Gemini 3.8 Live Extended Thinking 提供“增强的智能和多步推理”,适用于高复杂度的任务,例如最近推出的 Gmail Live(对话搜索)、Docs Live(草稿生成和编辑)及 Keep Live(笔记创建)。

该模型亦开始在 Gemini Live 上推广,3.8 Live Extended Thinking 能够“同时推理和讲述”。

该模型为复杂的工作流提供增强的智能,同时保持连贯的对话流,使用早期的口头提示,例如“让我检查一下……”,以自然地响应提示,并通过实时进度叙述,引导用户在多步骤的后台任务中逐步完成。就基准测试而言,“在人工分析语音对语音质量指数中,总排名第一(82.6)”;“在代理任务完成率方面,以 68.6% 的得分领先于 τ-Voice”;“在 Sierra 的 τ-Voice-banking 基准中得分 35.1%”;“具备强大的推理能力,在 Big Bench Audio 中得分 97.7%,同时在与其他前沿模型相比时保持高竞争价格。”

Gemini 3.8 Live 提供增强的对话智能

同时,Gemini 3.8 Live 基础模型提供“具有流畅对话和视觉基础的对话智能”。该模型能够近乎即时地处理“视觉输入”,并在对话持续进行的同时,后台执行工具和 API 调用。用户可以期待该模型在后台任务完成的同时,能够“响应请求并持续对话”。此外,它还能够在对话中检测并在 97 种支持的语言之间切换。该模型“为扩展和成本效益而设”,并在“语音代理竞技场中名列第二”。

Gemini 3.8 Live 将为 AI 模式的 Search Live 体验提供支持。

H
关于作者
Henderson