已验证70% 置信事实精确时间
本次对 Claude Opus 4.8 的多场景深度测试总计花费约 50 美元 Token 费用
4
来源数
70%
置信度
中期 (~90 天)
时效性
2026/5/30
首次发现
有效期至:2026/8/28
来源
Claude Opus 4.8 实测:游戏开发与UI还原能力全面评估
bilibili程序员刘行知2026/5/30
涉及实体
相关事实
待验证使用旗舰模型Claude Opus完成涉及20轮工具调用、每轮平均上下文10000 Token的任务,仅输入成本便可能超过3美元72% 相似待验证Opus 5 在 Low Effort 下的通过率约为 60%,超过了 Opus 4.8 在 Max 级别下的 59%,后者单任务成本高达 13 美元72% 相似待验证Claude Opus 4.8 was evaluated by a Bilibili creator named Xiao Liu through a series of real-world development tasks costing approximately $50 in Token costs.71% 相似待验证在同任务测试中,Claude Opus 4(Ultra模式)耗时约1小时,成本21.27美元71% 相似待验证一次完整的Deep Research任务可能消耗50万-200万Token,对应成本在$1-$5之间70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/304API
curl https://kongchang.com/api/v1/knowledge/claims/304MCP
get_claim(id=304)