Unverified90% confidenceFactTime unknown
LLaMA-Factory和Unsloth是社区中成熟的LoRA微调和SFT工具
1
Sources
90%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
MYLLM项目深度解读:用0.5B小模型跑通LLM全栈技术的个人实践
githubdinglizhong
Related Entities
Related Claims
Unverified借助LoRA、QLoRA等参数高效微调方法以及Coze、魔搭社区等无代码平台,无GPU资源和深度学习背景也能针对特定场景对模型进行定向优化61% similarUnverified围绕DeepSeek等模型已经形成了包括推理框架(vLLM、SGLang)、Agent框架(如MetaGPT、AutoGen的国产适配)在内的完整技术栈57% similarVerifiedUnsloth支持微调Gemma 4、Qwen3、DeepSeek、gpt-oss等主流开源大模型57% similarUnverified开源社区对o1的复现尝试包括DeepSeek-R1和QwQ,通过强化学习训练模型的推理过程是实现类似能力的关键路径57% similarUnverifiedDeepSeek的DFlash技术引发了社区对MTP支持的关注55% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/35397API
curl https://kongchang.com/api/v1/knowledge/claims/35397MCP
get_claim(id=35397)