ChengRang
EN

Gemini 3.8 Live 热门 新增

AI 对话助手 免费试用
本页为 Gemini 的版本 / 子产品详情。查看 Gemini 总览 →

Google DeepMind 2026/9/15 发布的近实时语音对话模型,含标准版与 Live Extended Thinking 两个变体:后者边推理边说话、面向多步复杂任务,Speech to Speech Quality Index 82.6 居首、τ-Voice 68.6%、Big Bench Audio 97.7%;支持 97 种语言中途切换、用户打断、后台工具调用与异步长任务,音频带 SynthID 水印

Google 实时语音 语音Agent 多模态 对话
访问 Gemini 3.8 Live 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 是 Google DeepMind 于 2026 年 9 月 15 日发布的两个近实时语音对话模型,官方称其为迄今最先进的实时对话模型。两个模型同日推出、共享同一底座,区别在于面向的场景:Gemini 3.8 Live 为规模化与成本效率构建,把对话智能、流畅交流与视觉接地(visual grounding)结合在一起;Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备更强的多步推理能力,能够一边推理一边说话。

Extended Thinking 的交互设计是这一代最有意思的变化。它会用「Let me check that…」这类提前给出的口头提示确认请求,然后在后台推进多步任务的同时持续用语音叙述进度,把等待过程变成可感知的对话,而不是让通话陷入沉默。两个模型都能在后台执行工具调用与 API 请求,同时继续与用户交谈,也支持用户随时打断并即时改口。

能力层面,两个模型都支持在对话中途自动检测并切换语言,覆盖 97 种语言;生成的音频统一使用 SynthID 加入不可感知水印。开发者通过 Gemini Live API 接入,Google AI Studio 中提供 /live 入口。企业侧走 Gemini Enterprise 私有预览,消费侧已经进入 Search Live、Gemini Live,以及 Workspace 的 Docs、Gmail、Keep。

核心功能

适合谁用

以下类型的用户会特别受益于 Gemini 3.8 Live:

优点亮点

价格与方案

Google 尚未公布具体费率,官方表述为相较其他前沿模型保持极具竞争力的价格,并强调 3.8 Live 的成本效率。开发者可通过 Gemini API 与 Google AI Studio(/live 入口)接入试用;Gemini Enterprise 走私有预览;面向普通用户的 Search Live 可直接使用,Extended Thinking 在 Google AI Pro 与 Ultra 订阅者的 Workspace Docs 中可用,所有 Google AI 订阅者可在 Gmail 与 Keep 中使用。具体定价以官方页面为准。

总结与建议

Gemini 3.8 Live 这一组模型解决的是语音助手最容易被抱怨的两件事:等得久,和不敢打断。标准版负责把实时对话做得便宜又稳,Extended Thinking 负责让复杂任务在通话里跑完。官方给出的成绩里,Extended Thinking 在 Artificial Analysis Speech to Speech Quality Index 上以 82.6 排名第一,τ-Voice 68.6%、Big Bench Audio 97.7%,语音智能体的任务完成能力是这轮升级的重点。需要做语音客服、实时指导、多步事务办理的产品值得优先测试这一代 Live API;如果只是文本对话需求,Gemini 3.8 Flash 一类的通用模型仍更直接。

版本演进

分类
AI 对话助手
价格
免费试用
标签
Google · 实时语音 · 语音Agent
官网