待验证80% 置信事实时间未知
Google的语音识别引擎支持超过125种语言,底层采用端到端的Transformer架构模型
1
来源数
80%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Google Vids免费做3D动画:Veo 3.1从零到成片完整教程
bilibili声译看世界
涉及实体
相关事实
待验证该项目技术栈选择微调多语言模型作为骨干,使用Whisper做语音识别和NLLB做翻译65% 相似已验证2022年谷歌Brain团队在论文《Emergent Abilities of Large Language Models》中首次系统记录了大语言模型的'涌现能力'现象64% 相似待验证Google 在 Translatotron 系列论文中探索了端到端语音翻译,证明其在保留说话人声纹、语速和情感信息方面具有优势并降低延迟64% 相似待验证2006年Google翻译初始系统使用了一个在数万亿词文本上训练的5-gram语言模型,这很可能是世界上第一次万亿token规模的语言模型训练63% 相似待验证当前AI语音翻译市场呈现两层结构:顶层是Google Translate、DeepL、Microsoft Translator等通用翻译平台,底层是针对垂直场景深度优化的专业工具61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/23148API
curl https://kongchang.com/api/v1/knowledge/claims/23148MCP
get_claim(id=23148)