待验证50% 置信事实精确时间
Gemini 3.5 Live Translate 将语音识别、语义理解、翻译和语音合成四个环节封装进同一个多模态大模型中联合优化
1
来源数
50%
置信度
长期有效
时效性
2026/7/8
首次发现
来源
谷歌AI密集更新:Gemini 3.5实时翻译、NotebookLM升级与DiffusionGemma解析
twitterGoogleAI2026/6/12
相关事实
待验证Gemini的语音生成模型目前基于Gemini 2.5,支持多语言和多口音输出83% 相似待验证Gemini 3.5 Live Translate 采用端到端学习范式,将ASR、NLU、MT、TTS四个环节在同一多模态大模型中联合优化80% 相似待验证Gemini 3.5 Live Translate 同时暴露了输入音频的转录(input transcription)接口79% 相似待验证Gemini 3.1 Pro具备多轮对话中的状态追踪能力,能将用户的自然语言需求增量式地映射到已有代码结构上77% 相似已验证谷歌发布了专为实时语音到语音翻译打造的 Gemini 3.5 Live Translate76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/238222API
curl https://kongchang.com/api/v1/knowledge/claims/238222MCP
get_claim(id=238222)