待验证50% 置信事实精确时间
MiniMax M3能够直接理解长视频内容,对12分钟的英伟达发布会视频进行理解并生成HTML格式新闻简报,且是直接'看'视频本身而非基于语音转文字
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
MiniMax M3实测对比GPT、Claude、Gemini:五个真实任务谁更强
bilibili数码旭2026/6/8
相关事实
待验证MiniMax M3 features a million-token-level ultra-long context window combined with audio and video multimodal understanding capabilities.76% 相似已验证MiniMax M3 is a multimodal model that supports text, video, images, and other modalities74% 相似待验证MiniMax M3模型的核心优势是超长上下文处理能力和多模态理解能力(可处理文字、图片和视频)73% 相似待验证借助 MiniMax H3 模型与 ComfyUI 上下文循环节点,可以在本地设备上生成时长超过一分钟的长视频72% 相似已验证MiniMax H3是一个多模态视频生成模型,能够同时生成视频画面和匹配的音频(包括对白、音效和环境音)71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/49537API
curl https://kongchang.com/api/v1/knowledge/claims/49537MCP
get_claim(id=49537)