待验证70% 置信事实时间未知
根据Metra的数据,GPT-3.5能处理人类专家约30秒完成的任务,GPT-4提升到约4分钟,Claude 3.5 Sonnet能自主完成人类专家预计需要12小时的任务
1
来源数
70%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
AI不是新工具,是软件业的工业化革命
bilibili赛博门外憨
涉及实体
相关事实
待验证Claude or GPT-4 may need 30 seconds or even longer when handling complex multi-file refactoring tasks76% 相似待验证在三任务对比中HY3以约14分钟完成全部任务,快于Fable 5(18分钟)、Sonnet 5(19分钟)和Opus 4.8(27分钟)76% 相似待验证在飞行模拟器测试中,GPT 5.5仅用约66,000 token和15分钟完成任务,而Opus 4.7消耗约200,000 token和18分钟72% 相似待验证GPT-5.6新增手动指定缓存点功能,缓存生命周期延长至30分钟71% 相似待验证GPT-5.6在40小时的长任务测试中,只要任务边界清晰就能连续工作很长时间而不丢失目标71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/10304API
curl https://kongchang.com/api/v1/knowledge/claims/10304MCP
get_claim(id=10304)