Unverified50% confidenceFactExact time
MiniMax M3能够直接理解长视频内容,对12分钟的英伟达发布会视频进行理解并生成HTML格式新闻简报,且是直接'看'视频本身而非基于语音转文字
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
MiniMax M3实测对比GPT、Claude、Gemini:五个真实任务谁更强
bilibili数码旭6/8/2026
Related Claims
UnverifiedMiniMax M3 features a million-token-level ultra-long context window combined with audio and video multimodal understanding capabilities.76% similarVerifiedMiniMax M3 is a multimodal model that supports text, video, images, and other modalities74% similarUnverifiedMiniMax M3模型的核心优势是超长上下文处理能力和多模态理解能力(可处理文字、图片和视频)73% similarUnverified借助 MiniMax H3 模型与 ComfyUI 上下文循环节点,可以在本地设备上生成时长超过一分钟的长视频72% similarVerifiedMiniMax H3是一个多模态视频生成模型,能够同时生成视频画面和匹配的音频(包括对白、音效和环境音)71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/49537API
curl https://kongchang.com/api/v1/knowledge/claims/49537MCP
get_claim(id=49537)