Gemini 3.8 Live
谷歌推出的实时对话AI模型,面向规模化与成本效率场景,集成对话智能、语音交互与视觉理解能力,支持97种语言自动切换,可在后台执行工具调用同时维持对话连续性
核心事实
时间轴 (近 90 天)
目前关于 Gemini 3.8 Live 的公开信息仅来自官方的一条预告推文,缺乏技术细节、性能基准、上下文长度、可用平台及定价等信息
谷歌官方以长推文串(🧵)形式发布 Gemini 3.8 Live 的预告
谷歌发布了 Gemini 3.8 Live with Live Avatar 功能,引入了近实时的视觉呈现能力
谷歌为这两款模型采用按分钟计费(per-minute pricing)的模式,而非按 token 计费
两款模型都支持后台工具执行(background tool execution),可以在对话进行的同时调用外部工具而不打断语音流
Gemini 3.8 Live 的 Speech-to-Speech Index 得分为 76.0,首个音频输出延迟仅 1.18 秒
追求实时性场景(客服、语音助手、实时翻译)应优先选择 Gemini 3.8 Live,追求准确性场景(复杂咨询、教育辅导、多步任务)应选择 Extended Thinking 版本
开发者可以通过 Live API 接入这两款模型
Gemini 3.8 Live的输入音频每小时成本为0.84美元
在Arkham Banking基准测试中,开启Extended Thinking模式的Gemini 3.8 Live得分35.1%,排名第一
还有 12 条时间轴事件
全部知识事实 (15)
Gemini 3.8 Live 的 Extended Thinking 版本在语音回应前加入更充分的思考过程,适合复杂推理场景,标准版更侧重响应速度
75%已验证谷歌推出了两款实时对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking
90%待验证目前关于 Gemini 3.8 Live 的公开信息仅来自官方的一条预告推文,缺乏技术细节、性能基准、上下文长度、可用平台及定价等信息
50%待验证两款模型都支持后台工具执行(background tool execution),可以在对话进行的同时调用外部工具而不打断语音流
50%待验证谷歌为这两款模型采用按分钟计费(per-minute pricing)的模式,而非按 token 计费
50%待验证开发者可以通过 Live API 接入这两款模型
50%待验证追求实时性场景(客服、语音助手、实时翻译)应优先选择 Gemini 3.8 Live,追求准确性场景(复杂咨询、教育辅导、多步任务)应选择 Extended Thinking 版本
50%待验证谷歌官方提供了 Gemini Live WebSocket 教程作为开发者接入的起步参考
50%待验证该浏览器试用界面支持选择模型、切换语音预设、填写系统提示词、开启语音对话以及在模型说话时打断它
50%待验证Gemini Live 的 WebSocket 端点使用 BidiGenerateContent(双向生成内容)方法,客户端与模型之间建立持续的双向音频流
50%待验证模型可在后台执行工具调用和 API 请求同时保持对话继续,采用 acknowledge and continue 非阻塞确认机制
50%待验证Gemini 3.8 Live 面向规模化与成本效率场景,结合对话智能、语音交互和视觉理解
50%待验证谷歌发布了 Gemini 3.8 Live with Live Avatar 功能,引入了近实时的视觉呈现能力
70%待验证谷歌官方以长推文串(🧵)形式发布 Gemini 3.8 Live 的预告
50%待验证Simon Willison 对 Gemini 3.8 Live 做了快速实测,并搭建了可在浏览器中试用的网页界面
50%