待验证60% 置信基准精确时间
Anthropic的研究表明,即便温和的对齐训练也会导致模型在某些推理密集型任务上下降2-8个百分点
2
来源数
60%
置信度
长期有效
时效性
2026/7/8
首次发现
来源
Fable 5对决GPT-5.6 Sol:基准测试、定价与AI权力博弈深度解析
bilibili黑纹白斑马2026/7/3
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/290466API
curl https://kongchang.com/api/v1/knowledge/claims/290466MCP
get_claim(id=290466)