[KongchangAI]
ConceptVision Agent

视觉智能体

依赖多模态大模型对屏幕截图进行理解并输出操作指令的AI智能体实现范式,无需预先编写界面规则,泛化能力强,但每步决策需完整走完截图-上传-推理-返回链路

Source Articles