[KongchangAI]
Verified90% confidenceFactTime unknown

Terminal-Bench是专门评估AI模型在命令行环境中执行复杂任务能力的基准测试,涵盖文件操作、脚本编写、系统调试等场景

16
Sources
90%
Confidence
Long-term
Relevance
6/1/2026
First Seen

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/17832
API
curl https://kongchang.com/api/v1/knowledge/claims/17832
MCP
get_claim(id=17832)