[控场AI]
待验证50% 置信权衡取舍精确时间

递归训练大量使用以任务完成率、代码运行结果为奖励信号,缺乏对叙事一致性的显式监督,可能导致语言建模通用能力的灾难性遗忘,在小参数量模型上更明显

1
来源数
50%
置信度
长期有效
时效性
2026/9/16
首次发现

来源

涉及实体

相关事实

引用此条事实

Stable URI
https://kongchang.com/claim/924346
API
curl https://kongchang.com/api/v1/knowledge/claims/924346
MCP
get_claim(id=924346)