Unverified55% confidenceFactTime unknown
MiniMind-V的整体架构设计参考了LLaVA(Large Language and Vision Assistant)的经典范式
1
Sources
55%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
MiniMind-V:2小时从零训练65M参数视觉多模态大模型完整教程
githubjingyaogong
Related Entities
Related Claims
Unverified豆包2.0 Mini支持视觉理解(Vision Understanding)功能,底层采用Vision Transformer(ViT)架构将图片编码为token序列73% similarUnverified通用实验室(Tongying Lab)发布了视觉-语言-动作(Vision-Language-Action)模型66% similarUnverifiedMiniMax M3模型的核心优势是超长上下文处理能力和多模态理解能力(可处理文字、图片和视频)65% similarUnverified蓝图是虚幻引擎的可视化脚本系统,底层编译为字节码由UE虚拟机解释执行,性能略低于原生C++但开发效率更高65% similarUnverified支持自动梯形校正、自动对焦、智能避障等功能,开机到可看画面的调试时间很短,适合不愿手动调校的用户63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/29984API
curl https://kongchang.com/api/v1/knowledge/claims/29984MCP
get_claim(id=29984)