待验证50% 置信解决方案精确时间
项目实现了涵盖Top-k、Top-p、重复惩罚和n-gram屏蔽的文本生成策略,用于对抗小模型的重复循环缺陷
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
15岁少年从零训练200M MoE语言模型:完整架构与实战拆解
redditr/learnmachinelearning2026/7/12
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/501391API
curl https://kongchang.com/api/v1/knowledge/claims/501391MCP
get_claim(id=501391)