Unverified90% confidenceFactTime unknown
LLaVA的训练分为两个阶段:第一阶段是预训练对齐(冻结视觉编码器和语言模型,仅训练投影层),第二阶段是指令微调(解冻语言模型进行端到端训练)
1
Sources
90%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
MiniMind-V:2小时从零训练65M参数视觉多模态大模型完整教程
githubjingyaogong
Related Entities
Related Claims
Unverified微调VLA模型时通常采用分层学习率策略:视觉编码器使用极小学习率或冻结,语言模型层使用中等学习率,动作专家使用较大学习率73% similarUnverified训练风格统一的参考图即可训练出专属风格的LoRA模型68% similarUnverified子曰大模型在预训练和微调阶段大量使用了教材、习题、解题过程等教育语料,使其在教育任务上具备更强的专业性68% similarUnverifiedQwQ-32B采用两阶段强化学习训练策略:第一阶段在数学和编程任务上进行强化学习,第二阶段扩展到通用领域68% similarUnverifiedCAI训练分为两阶段:先让模型依据原则进行自我批评与修正(SL-CAI),再通过基于AI反馈的强化学习(RLAIF)优化67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/29993API
curl https://kongchang.com/api/v1/knowledge/claims/29993MCP
get_claim(id=29993)