SWE-Pro是一个用于评估人工智能模型软件工程能力的基准测试,专注于衡量模型在真实编程任务中的表现,包括代码理解、缺陷修复、功能实现等方面。该基准测试通常以实际软件项目中的问题为基础,考察模型解决复杂工程问题的综合能力,是衡量AI编程助手实用性的重要参考指标之一。