待验证90% 置信事实时间未知
LLaVA的训练分为两个阶段:第一阶段是预训练对齐(冻结视觉编码器和语言模型,仅训练投影层),第二阶段是指令微调(解冻语言模型进行端到端训练)
1
来源数
90%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
MiniMind-V:2小时从零训练65M参数视觉多模态大模型完整教程
githubjingyaogong
涉及实体
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/29993API
curl https://kongchang.com/api/v1/knowledge/claims/29993MCP
get_claim(id=29993)