待验证50% 置信事实精确时间
SWE-2代表自主智能体(Agent)路线,即接收任务目标后独立规划、执行、验证,人类主要负责下达任务和审核最终结果
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证SWE-agent、Devin等系统是规划-执行-反思Agent架构的典型实现76% 相似待验证SWE-bench的任务设计本质上是单次任务,Agent在干净环境中处理独立Issue,掩盖了跨会话记忆缺失的问题70% 相似待验证SWE-bench是评估AI编程工具能力的权威基准,从真实GitHub Issue中提取任务,要求Agent自主定位代码、修复Bug并通过测试70% 相似已验证智能体(Agent)是具备自主决策能力的AI,能自行拆解任务如搜索信息、提取内容、生成报告69% 相似待验证SWE-Agent架构通常包括文件浏览器、搜索工具、编辑器和终端,模型作为Agent的大脑进行规划和工具调用69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/906920API
curl https://kongchang.com/api/v1/knowledge/claims/906920MCP
get_claim(id=906920)