[控场AI]
模型Gemini 3.8 Live

Gemini 3.8 Live

谷歌推出的实时对话AI模型,面向规模化与成本效率场景,集成对话智能、语音交互与视觉理解能力,支持97种语言自动切换,可在后台执行工具调用同时维持对话连续性

核心事实

时间轴 (近 90 天)

9月30日

目前关于 Gemini 3.8 Live 的公开信息仅来自官方的一条预告推文,缺乏技术细节、性能基准、上下文长度、可用平台及定价等信息

待验证50%
9月30日

谷歌官方以长推文串(🧵)形式发布 Gemini 3.8 Live 的预告

待验证50%
9月24日

谷歌发布了 Gemini 3.8 Live with Live Avatar 功能,引入了近实时的视觉呈现能力

待验证70%
9月16日

谷歌为这两款模型采用按分钟计费(per-minute pricing)的模式,而非按 token 计费

待验证50%
9月16日

两款模型都支持后台工具执行(background tool execution),可以在对话进行的同时调用外部工具而不打断语音流

待验证50%
9月16日

Gemini 3.8 Live 的 Speech-to-Speech Index 得分为 76.0,首个音频输出延迟仅 1.18 秒

已过期50%
9月16日

追求实时性场景(客服、语音助手、实时翻译)应优先选择 Gemini 3.8 Live,追求准确性场景(复杂咨询、教育辅导、多步任务)应选择 Extended Thinking 版本

待验证50%
9月16日

开发者可以通过 Live API 接入这两款模型

待验证50%
9月16日

Gemini 3.8 Live的输入音频每小时成本为0.84美元

已过期50%
9月16日

在Arkham Banking基准测试中,开启Extended Thinking模式的Gemini 3.8 Live得分35.1%,排名第一

已过期50%

还有 12 条时间轴事件

全部知识事实 (15)

已验证

Gemini 3.8 Live 的 Extended Thinking 版本在语音回应前加入更充分的思考过程,适合复杂推理场景,标准版更侧重响应速度

75%
已验证

谷歌推出了两款实时对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking

90%
待验证

目前关于 Gemini 3.8 Live 的公开信息仅来自官方的一条预告推文,缺乏技术细节、性能基准、上下文长度、可用平台及定价等信息

50%
待验证

两款模型都支持后台工具执行(background tool execution),可以在对话进行的同时调用外部工具而不打断语音流

50%
待验证

谷歌为这两款模型采用按分钟计费(per-minute pricing)的模式,而非按 token 计费

50%
待验证

开发者可以通过 Live API 接入这两款模型

50%
待验证

追求实时性场景(客服、语音助手、实时翻译)应优先选择 Gemini 3.8 Live,追求准确性场景(复杂咨询、教育辅导、多步任务)应选择 Extended Thinking 版本

50%
待验证

谷歌官方提供了 Gemini Live WebSocket 教程作为开发者接入的起步参考

50%
待验证

该浏览器试用界面支持选择模型、切换语音预设、填写系统提示词、开启语音对话以及在模型说话时打断它

50%
待验证

Gemini Live 的 WebSocket 端点使用 BidiGenerateContent(双向生成内容)方法,客户端与模型之间建立持续的双向音频流

50%
待验证

模型可在后台执行工具调用和 API 请求同时保持对话继续,采用 acknowledge and continue 非阻塞确认机制

50%
待验证

Gemini 3.8 Live 面向规模化与成本效率场景,结合对话智能、语音交互和视觉理解

50%
待验证

谷歌发布了 Gemini 3.8 Live with Live Avatar 功能,引入了近实时的视觉呈现能力

70%
待验证

谷歌官方以长推文串(🧵)形式发布 Gemini 3.8 Live 的预告

50%
待验证

Simon Willison 对 Gemini 3.8 Live 做了快速实测,并搭建了可在浏览器中试用的网页界面

50%

来源文章