Unverified50% confidenceBenchmarkExact time
Prism ML白皮书报告Bonsai 2在TerminalBench 2.1上保留约76%、在SWE-bench Verified上约75%的原模型分数,这两项长链基准未计入98%平均值
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
10/4/2026
First Seen
Valid until: 1/2/2027
Sources
Related Entities
Related Claims
Unverified官方声称 Bonsai 2 在 Top-1 指标上能保留超过 98% 的 FP16 表现63% similarUnverified根据模型卡片,Ternary Bonsai 2 体积缩小到FP16的九分之一,同时保留98.2%的智能表现63% similarUnverified在256K上下文的大海捞针测试中,两款模型表现完全一致,均取得93%的成绩,仅在100%满上下文深度时各有一次失败57% similarUnverified在DeepSuite V1.1基准下,同一模型在不同harness下的成绩从69.8%波动到74.2%56% similarUnverified测试数据表明RNN头与马尔可夫头的草稿通过率差距仅在1-2%以内,而部署成本差距可达数倍55% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/973453API
curl https://kongchang.com/api/v1/knowledge/claims/973453MCP
get_claim(id=973453)