[
控场AI
]
知识动态
实体
播客
深度
开发者
关于
Get CLI
EN
产品
Terminus-2
Harbor框架中使用的Agent评估运行时之一,用于在统一框架下驱动模型执行基准测试任务
时间轴 (近 90 天)
9月11日
每个模型使用Terminus-2或三种原生harness之一运行
待验证
50%
全部知识事实 (1)
待验证
每个模型使用Terminus-2或三种原生harness之一运行
50%
来源文章
Harbor:统一80+基准的AI Agent评估框架详解
9月11日