Gemini 3.8 Live

厂商 / 系列
GoogleGemini
上下文
131K
输入价
$0.75 / 百万 tokens
输出价
$4.50 / 百万 tokens
许可
闭源

快速对比

选择一个模型,与 Gemini 3.8 Live 并排比较关键规格。

查看 Gemini 系列对比

COMPARE MATRIX · 横向比较

模型比较

并列查看 0 项模型的关键规格

当前不足 2 项,可关闭面板后继续选择。

已选模型规格比较矩阵
比较项
规格暂无可比较规格
提示:左右滚动可查看全部项目

概览

Google 的原生语音到语音实时对话模型:边说话边在后台调用工具,能看实时画面、准确听写验证码和单号,覆盖 97 种以上语言,是 Gemini Live API 的默认模型。 原生语音到语音:低延迟实时对话,官方定位为 Live API 默认模型,替代级联式「语音识别 + 文本模型 + 语音合成」方案 异步函数调用:后台执行 API 和工具调用的同时继续播报语音,默认非阻塞(NON_BLOCKING),支持 SILENT / WHEN_IDLE / INTERRUPTED 调度 视觉上下文:结合实时画面理解用户「说的」和「看到的」 字母数字精度:准确识别确认码、理赔单号和技术参数 覆盖 97 种以上语言并保持口音一致;支持增量内容更新,把实时音频与结构化数据合并 支持 Google 搜索 grounding、函数调用和交错推理(interleaved reasoning);不支持缓存、结构化输出、代码执行和 Batch API Extended Thinking 版支持可配置思考,在后台做多步推理的同时继续对话,官方称在 Artificial Analysis 语音到语音榜排名第一 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 是 Google DeepMind 在 2026 年 9 月 15 日通过 Gemini API 和 Google AI Studio 发布的新一代实时语音模型(官方博客《Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe》)。官方称这一代相比之前的 Live 模型是「阶跃式提升」,能在保持对话流畅的同时推理并执行任务;需要更深推理时用 Extended Thinking 版,它可以在后台多步思考,同时在主对话里回应或播报进度。两款模型都通过 Live API 调用,也可以经由 Agora、Fishjam、LiveKit、LangChain、Pipecat、Vercel、Vision Agents 等合作方接入。 从 gemini-3.1-flash-live-preview 迁移时要注意:模型名改为 gemini-3.8-live;gemini-3.8-live 不支持 thinking_level,需要从会话配置里去掉;异步函数调用变为默认(仍可在工具声明里设 behavior: BLOCKING 保持同步);send_client_content 在整个会话中都可用,设置 turn_complete=true 会立即打断正在生成的内容;主动音频(proactive audio)永久开启,设为 false 会报错;情感对话(affective dialog)参数已移除;视频帧默认会发送给模型,只在需要时发送以控制上下文和成本;如需文字记录,请开启输出音频转写。上手:在 ai.studio/live 试用,或从官方 GitHub 克隆示例应用。价格按每百万 token 计(见上),Google 搜索 grounding 与其他 Gemini 3.x 模型共享每月 5,000 次免费额度,之后每 1,000 次 $14。来源:blog.google 官方博客、ai.google.dev 模型页(gemini-3.8-live / gemini-3.8-live-extended-thinking)与定价页(2026-10-07 核对)。 API ID: gemini-3.8-live(Live API);gemini-3.8-live-extended-thinking

模态
多模态
许可说明
闭源 · 闭源