Unverified50% confidenceOpinionExact time
不同模型在抗诱导能力上的差异很大程度上源于后训练阶段(post-training)的策略差异
1
Sources
50%
Confidence
Long-term
Relevance
8/19/2026
First Seen
Sources
Related Claims
Unverified后训练的成熟度直接决定模型的token效率,成熟的后训练能减少无效推理token的消耗79% similarUnverified小版本号跃迁通常对应后训练(Post-Training)阶段的优化,而非预训练的重新训练77% similarUnverified大模型进入后预训练时代后,单纯堆砌参数带来的能力收益愈发递减,厂商转向后训练阶段寻求突破77% similarUnverified跨模型引用行为差异的根源包括预训练语料差异、SFT数据集差异和RLHF阶段人类标注者群体差异77% similarUnverified迁移学习中通常有两种策略:冻结预训练模型大部分层只训练分类头(Feature Extraction),或用预训练权重初始化后以较小学习率微调所有层(Fine-Tuning)74% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/774276API
curl https://kongchang.com/api/v1/knowledge/claims/774276MCP
get_claim(id=774276)