资讯动态 · 消息 · 实时语音

Gemini 3.8 Live 正式可用:实时语音新增两种模型选择

Google 9 月 15 日发布 Gemini 3.8 Live 与 Extended Thinking。了解实时语音选型、异步工具调用和接入检查重点。

RootFlowAI 内容维护团队 · 发布 · 核对

Google 在 2026 年 9 月 15 日 的 Gemini API 更新日志中宣布,Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 达到正式可用阶段,面向使用 Live API 的实时语音应用。

两个模型分别使用 gemini-3.8-livegemini-3.8-live-extended-thinking。官方将前者推荐给多数强调低延迟的语音 Agent 和实时对话,后者面向需要更强后台推理能力的场景。

这次更新涉及什么

更新日志列出了交错推理、默认异步函数调用以及完整的会话客户端内容更新等能力。对于开发者,这些变化涉及会话和工具执行的配合,需要连同 Live API 文档一起理解。

例如,用户讲话时触发了外部查询,应用需要处理查询等待、用户打断和后续回复的顺序。模型支持异步工具调用,并不能代替应用自身的超时处理、取消机制和结果关联。

两种模型如何选择

如果场景是实时问答、客服入口或低延迟交互,可以从官方推荐的普通 Live 版本开始评估。如果业务需要在持续语音交互中进行更多后台推理,再对照 Extended Thinking 的表现。

不要只比较文字回答质量。语音应用还应观察开始播放回复的时间、打断后的恢复、工具等待期间的体验、噪声环境下的行为和会话中断后的处理。是否适合中文场景也应使用真实中文样本验证。

已有接口能否直接使用

Live API 是独立的实时交互能力,接入不能仅凭“已经支持 Gemini 文本模型”来判断。需要核对客户端采用的会话协议、服务商是否开放 Live 路径、身份验证方式、模型 ID 以及流式音频处理。

这次正式可用也不自动等于所有旧预览模型立即停用。若使用旧模型,应分别查看弃用时间表和当前模型文档,再安排版本切换。

上线前建议记录的结果

准备一组固定语音任务,记录模型版本、语言、网络位置、工具数量与完成情况。对比两种模型时保持任务和环境一致,避免把网络延迟或不同工具耗时算成模型能力差异。

本文是官方发布信息整理,未对 RootFlowAI 的 Live API 支持或这两款模型进行实测。具体访问权限、限制和价格以所选服务商的当前说明为准。

资料来源

接下来可以做什么

查看其他模型与接口动态