待验证50% 置信基准精确时间
在第三轮结构性组合任务的 IID 测试(21 题)中,GAN8 达到 95.2%,高于 JEV 的手工权重 76.2%、线性训练 71.4%、MLP 85.7%
1
来源数
50%
置信度
长期有效
时效性
2026/9/21
首次发现
来源
涉及实体
相关事实
待验证在纯奇偶校验任务上,GAN8 达到 100%,JEV MLP 为 67%,JEV 线性为 33%77% 相似待验证GPT-3有175B参数、训练300B token,Gopher有280B参数、训练300B token,均属于过参数化欠训练状态61% 相似待验证在综合基准测试中,So得55分(约78.6%),Terra得44分(约62.9%),Luna得31分(约44.3%)61% 相似待验证Bullet 在 SWE-bench Verified 基准测试中取得 95.8% 的成绩,位列前三,平均每个任务耗时 119 秒61% 相似待验证Cognition发布SWE2,基于Kimi K3后训练,官方称在主要评测上与前沿模型得分相当,但成本最多低70%60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/939306API
curl https://kongchang.com/api/v1/knowledge/claims/939306MCP
get_claim(id=939306)