Unverified85% confidenceEventTime unknown
小米正式发布自研语音合成大模型MIMO VR-PTS,基于自研Audio Tokenizer和多码本语音文本联合建模架构,经过上亿小时语音数据预训练
1
Sources
85%
Confidence
Medium-term (~90 days)
Relevance
6/1/2026
First Seen
Valid until: 8/30/2026
Sources
Meta关停元宇宙核心项目,800亿美元换来的教训
bilibili初芽Sprout
Related Entities
Related Claims
Unverified小米MIMO开放了MIMO 2.5 ASR语音识别模型API,支持中英等多语言实时语音转文字,按音频时长计费75% similarUnverifiedMiMo VL TTS在预训练阶段采用了上亿小时的语音数据,支持同一句话内完成语气转折和情感递变72% similarVerifiedWhisper是OpenAI于2022年开源的自动语音识别模型,采用Transformer架构,在68万小时多语言音频数据上训练而成71% similarUnverified当前旗舰级语音产品普遍采用大规模预训练语言模型与专用语音解码器联合训练的方案68% similarUnverified语音编码器 + LLM 解码器的组合是 2023 年以来语音大模型的主流范式,Qwen-Audio、Gemini Audio、Phi-4-audio 等均采用类似设计66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/22810API
curl https://kongchang.com/api/v1/knowledge/claims/22810MCP
get_claim(id=22810)