待验证50% 置信基准精确时间
在Terminal Bench 2.1上,单Agent成绩为88.8%,开启Ultra后达到91.9%,但成本约为单Agent的3倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/15
首次发现
有效期至:2026/10/13
来源
相关事实
待验证多Agent并发调用的Token消耗实际可能达到单Agent的3-8倍59% 相似待验证以Anthropic官方定价为例,缓存命中token的计费通常仅为正常输入token的十分之一左右59% 相似待验证Claude Opus 4.8在500步预算下OSWorld 2.0完成率仅20.6%,部分得分54.8%,每个任务平均成本约72.4美元59% 相似待验证三Agent架构的成本是单Agent的约20倍(200美元 vs 9美元),但输出质量从'不可用'提升到'可实际使用'59% 相似待验证按照GPT-4o输入约$2.5/百万Token的定价估算,AgentMemory一年使用成本大约只需10块钱59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/511328API
curl https://kongchang.com/api/v1/knowledge/claims/511328MCP
get_claim(id=511328)