Verified65% confidenceFactTime unknown
GPT-4o等多模态模型已支持对实时音频的原生处理
3
Sources
65%
Confidence
Long-term
Relevance
5/31/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedGPT-4o 已初步实现音频端到端处理83% similarVerifiedGPT-4o 的端到端语音架构将音频以离散 token 的形式纳入统一的 Transformer 处理框架,在单一模型内完成听-想-说全链路处理80% similarVerifiedGPT-Live 采用端到端语音模型,直接处理音频波形输入并输出音频波形,中间不经过文字转换79% similarUnverified多模态大模型如GPT-4o的实时语音交互能力正在将情感计算从实验室推向产品应用79% similarVerifiedGPT-4o采用原生多模态架构,音频输入和输出不经过文本中间层78% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/9135API
curl https://kongchang.com/api/v1/knowledge/claims/9135MCP
get_claim(id=9135)