待验证50% 置信事实精确时间
早期 GUI Agent 方案依赖计算机视觉截图分析(如 GPT-4V),存在延迟高、定位不精准的问题
1
来源数
50%
置信度
长期有效
时效性
2026/7/6
首次发现
来源
阿里开源Page-Agent:自然语言操控网页的Web智能体
githubGitHub Trending2026/7/5
相关事实
待验证据估计仅GPT-4的工具调用能力就经历了数千小时人工标注和数轮迭代优化74% 相似待验证GPT-4V 等多模态模型在直接输出屏幕坐标时存在显著的空间定位偏差73% 相似待验证GPT-4等大模型在CTF题目中展现出一定的漏洞分析能力,但在真实世界复杂代码库中的准确率仍远低于人类专家70% 相似待验证一位开发者使用医院物资柜实时监控系统(包含3D场景渲染、传感器数据监控、物资进出记录等功能,技术栈为TypeScript前端和Go后端)对Cursor + GPT-5和Buddy + Claude Sonnet 4进行了三轮编码能力实测对比70% 相似待验证GPT-4 Thinking在编程测试中能精准定位Vue前端Bug、分析原理、追踪执行流程并给出完整解决方案70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/115341API
curl https://kongchang.com/api/v1/knowledge/claims/115341MCP
get_claim(id=115341)