[控场AI]
基准

OfficeQA Pro V1

Databricks发布的企业级AI模型评测基准,用于衡量模型在办公类问答任务中的综合表现,包括回答质量与成本效率等维度

时间轴 (近 90 天)

10月8日

在Databricks的OfficeQA Pro V1评测中,Claude Haiku 5.5相比上一代Haiku 4.5实现了约15%的质量提升,同时成本仅为后者的一小部分

待验证50%

全部知识事实 (1)

来源文章