HeadlinesBriefing favicon HeadlinesBriefing.com

Gemini 3.8 Live 与 Live Extended Thinking 发布

Hacker News •
×

Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 是我们迄今最先进的实时对话模型。智能与并行推理方面的重大升级,使它们在与用户协作以及使用语音执行复杂任务时更加直观。Malini Jaganathan,技术团队成员,代表 Gemini Audio 团队。

今天,我们推出两款新模型,将接近实时的推理能力提升到新高度,更有效地赋能语音智能体,并让与 AI 的对话感觉更直观、更智能。Gemini 3.8 Live:为规模化和成本效率而打造,将会话智能与流畅对话和视觉基础相结合。Gemini 3.8 Live Extended Thinking:为高复杂度任务而打造,具备更强的智能和多步推理能力。

Gemini 3.8 Live Extended Thinking 提供企业级的任务完成能力和智能水平,在 Artificial Analysis 的语音到语音质量指数中夺得第1名82.6),并在智能体任务完成方面领先,在 τ-Voice 上达到 68.6%,在 Sierra 的 τ-Voice-banking 基准测试中达到 35.1%。它还提供强大的推理能力,在 Big Bench Audio 上得分 97.7%,同时与其他前沿模型相比保持了极具竞争力的价格。Gemini 3.8 Live 在用户中表现出很高的偏好度,在 Speech Agent Arena 中位居第二。

Gemini 3.8 Live 以接近实时的方式处理视觉输入,为对话增添上下文,从而提供更有帮助的回应。它能在对话中途自动检测并在 97 种支持语言之间切换。它在继续对话的同时在后台执行工具和 API 调用。对于需要更深层推理的任务,3.8 Live Extended Thinking 能够边推理边说话。

关键实体:公司:Google、Google Workspace、Search、Gemini、Artificial Analysis、Sierra、Service Now、Agora、Fishjam、Lang Chain、Live Kit、Pipecat、Vercel、Vision Agents、Salesforce、Genspark、Lumeris | 人物:Malini Jaganathan

FAQ:Gemini 3.8 Live Extended Thinking 的关键基准测试有哪些?

Gemini 3.8 Live Extended Thinking 在 Artificial Analysis 的语音到语音质量指数中得分 82.6,在 τ-Voice 上达到 68.6%,在 Sierra 的 τ-Voice-banking 基准测试中达到 35.1%,在 Big Bench Audio 上得分 97.7%。

FAQ 问题:Gemini 3.8 Live Extended Thinking 的关键基准测试有哪些?

FAQ 回答:Gemini 3.8 Live Extended Thinking 在 Artificial Analysis 的语音到语音质量指数中得分 82.6,在 τ-Voice 上达到 68.6%,在 Sierra 的 τ-Voice-banking 基准测试中达到 35.1%,在 Big Bench Audio 上得分 97.7%。