基准
AgentX
由SemiAnalysis推出的公开Agentic基准,用于评估推理框架在真实Agent工作负载下的性能,模拟多工具调用、多轮上下文积累、并发任务编排等典型Agent流量模式
时间轴 (近 90 天)
10月4日
该测试运行在 SemiAnalysis 的 AgentX 基准环境中
待验证50%
10月4日
SemiAnalysis 的 AgentX 基准专门面向 AI Agent 场景设计,核心关注单用户条件下的解码延迟而非最大吞吐量
待验证50%
9月15日
vLLM 团队发布了技术博客《vLLM x AgentX: Optimizing for Real-World Agentic Serving》
待验证50%
9月15日
vLLM 团队使用由 SemiAnalysis 推出的公开 Agentic 基准 AgentX 进行测量
待验证50%
9月15日
业界长期缺乏针对 Agentic 工作负载的标准化评测体系,AgentX 填补了这一空白
待验证50%