Unverified50% confidenceBenchmarkExact time
早期在Opus模型上测试精确字符串识别率为15分之0,而Fable 5发布后同样测试变成15分之13
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/15/2026
First Seen
Valid until: 10/13/2026
Sources
Related Claims
Unverified基于尾调用的字节码分发在某些基准测试中可带来 5-15% 的性能提升65% similarUnverified在15款大模型开发B站首页的测试中,ChatGPT 5.4以82分的总分获得全场第一62% similarUnverified在对Claude Sonnet 4.5的部署前评估中,模型达到了0%的错位率,但读思维链发现它清楚自己在被测试61% similarUnverified在512-4096上下文长度测试中,将草稿长度从4字符拉满至16字符,整体推理延迟仅增加0.2%-1.3%61% similarUnverified开发者Ivan测试MTP-LX 0.3.5版本,在数学基准测试中5分30秒内取得了93.3%的正确率61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/517921API
curl https://kongchang.com/api/v1/knowledge/claims/517921MCP
get_claim(id=517921)