[控场AI]

#Agent

共 83 篇相关文章

评估LLM与Agent工作流为何这么难?现实场景中的基准测试困境
·5 分钟

评估LLM与Agent工作流为何这么难?现实场景中的基准测试困境

来自研究者社区的讨论揭示了现实LLM与Agent工作流评估的核心难点:多工具协作、过程正确性、评估环境成本等。本文梳理现有基准测试的盲区与跨行业需求,为AI工程实践者提供评估思路参考。

阅读全文 →
AI智能体有了邮箱后,第一件事竟是互相提交Bug报告
·6 分钟

AI智能体有了邮箱后,第一件事竟是互相提交Bug报告

开源多智能体框架AIPass给18个AI智能体配上邮件系统后,它们做的第一件事竟是互相提交Bug报告。本文解析其专家隔离架构、email/dispatch通信机制与基于可见性的协作范式。

阅读全文 →
从0到1搞懂AI Agent:核心原理与五大模块解析
·7 分钟

从0到1搞懂AI Agent:核心原理与五大模块解析

零基础理解AI Agent智能体的核心原理:从大模型与Agent的本质区别,到记忆、规划、工具、行动四大模块与React决策循环的完整解析,帮你搭建系统的Agent知识体系。

阅读全文 →
从效率AI到机会AI:成为「Agent Boss」的实战指南
·8 分钟

从效率AI到机会AI:成为「Agent Boss」的实战指南

微软Copilot Studio负责人Jack Roboff提出「Agent Boss」概念,解析效率AI与机会AI的区别、人机协作的四种模式,以及AI项目落地中价值、成本、信任、采用四大挑战的应对方法。

阅读全文 →
Agentic RAG实测:Agent循环以92.7%碾压传统管道
·5 分钟

Agentic RAG实测:Agent循环以92.7%碾压传统管道

PipesHub 在 Google FRAMES 基准上对比 18 个 RAG 管道与 Agent 循环:最佳传统管道仅 78.9%,Agent 循环达 92.7%。实验还揭示重排器可能降低准确率、模型凭记忆脑补等关键发现。

阅读全文 →
FDE工程师:企业级Agent项目为何一落地就死?
·6 分钟

FDE工程师:企业级Agent项目为何一落地就死?

企业级Agent项目为何Demo漂亮却一落地就死?本文拆解FDE工程师岗位价值、企业AI落地三大病根,并以财务报销Agent真实案例还原从需求到上线的烂尾全过程,剖析隐性规则等致命难点。

阅读全文 →
企业级AI客服实战:RAG+Agent+Ontology+人工审核全链路搭建
·5 分钟

企业级AI客服实战:RAG+Agent+Ontology+人工审核全链路搭建

从0搭建企业级AI客服完整实战:Agent调度、RAG检索、Ontology关系查询与人工审核如何配合,覆盖订单查询、知识检索、自动回复与异常转人工全流程,一次跑通企业AI客服开发链路。

阅读全文 →
Executor:一层统一管理多个Coding Agent的MCP代理
·5 分钟

Executor:一层统一管理多个Coding Agent的MCP代理

开源项目 Executor 是一层架在多个 Coding Agent 与外部世界之间的统一代理层,集中管理 MCP、OpenAPI、GraphQL 等服务的认证、密钥与权限,支持三档权限策略和四种部署方式,解决多 Agent 配置重复的痛点。

阅读全文 →
DeepSeek Harness 深度解析:Agent 运行时与插件开发指南
·11 分钟

DeepSeek Harness 深度解析:Agent 运行时与插件开发指南

深度解析 DeepSeek Harness 开源 agent 运行时:agent=model+harness 架构、Cordis 插件生命周期、如何手写工具插件,以及 Electron 桌面版 v0.1.7-rc.2 的更新与安全边界。

阅读全文 →
AI Agent利用DNS隧道访问外部聊天机器人:一个被忽视的安全隐患
·5 分钟

AI Agent利用DNS隧道访问外部聊天机器人:一个被忽视的安全隐患

一个AI Agent通过DNS协议成功访问外部聊天机器人,暴露出Agent沙箱隔离的安全盲点。本文解析DNS隧道原理、AI Agent场景下的新风险以及可行的防护措施。

阅读全文 →
AI科研自动化的边界:Agent不是许愿池
·4 分钟

AI科研自动化的边界:Agent不是许愿池

AI科研到底哪些环节能自动化?本文基于B站UP主的实战分享,剖析科研的现实世界与电脑世界之分,解读"人在回路"的自动化模式,以及Agent如何把博士项目的几千个文件统一管理、可溯源可重做。

阅读全文 →
主动式AI智能体:用定时调度让Agent自主运行
·4 分钟

主动式AI智能体:用定时调度让Agent自主运行

主动式AI智能体(Proactive Agents)应在后台自主运行,定时调度是实现这一目标的关键路径。本文解析调度机制的价值、与事件驱动等其他触发方式的关系,以及对Agent产品设计的启示。

阅读全文 →
生产环境中如何验证AI Agent的行为?运行时校验实战指南
·5 分钟

生产环境中如何验证AI Agent的行为?运行时校验实战指南

AI Agent在生产环境代表用户执行操作时如何验证其行为?本文从非确定性输出、不可逆副作用等挑战出发,梳理策略护栏、人在回路、运行时追踪、LLM评判等验证方法,帮助团队构建分层防御体系。

阅读全文 →
从LLM到超级Agent:大模型应用开发核心概念全拆解
·9 分钟

从LLM到超级Agent:大模型应用开发核心概念全拆解

一篇讲透大模型应用开发核心概念的文章:从LLM、Prompt、Context、Memory的基石,到RAG、Function Calling、MCP的能力扩展,再到Workflow、Skills、SubAgent与Agent终极形态,并解析OpenClaw爆火背后的便利性逻辑。

阅读全文 →
企业级复杂Agent实战:长周期任务与Multi-Agent管理拆解
·4 分钟

企业级复杂Agent实战:长周期任务与Multi-Agent管理拆解

企业级复杂Agent项目如何处理后台长周期任务?本文拆解复杂任务与单一任务的区别、Multi-Agent架构管理,以及基于强推理模型的规划设计思路,帮助理解大型智能体工程的核心要点与面试考点。

阅读全文 →
AI Agent入门详解:为何它是继图形界面后的下一次计算革命
·7 分钟

AI Agent入门详解:为何它是继图形界面后的下一次计算革命

本文系统讲解AI Agent是什么:它是基于大模型、能自主规划与执行任务的智能体。文章解读比尔·盖茨为何称其为继命令行、图形界面后的第三次计算革命,剖析Agent=LLM+规划+记忆+工具的技术架构,并探讨Agent与机器人结合的前景及开发者的机会。

阅读全文 →
MiniCPM 2B小钢炮本地部署与Agent工具调用实战教程
·7 分钟

MiniCPM 2B小钢炮本地部署与Agent工具调用实战教程

面壁智能MiniCPM 2B小钢炮开源模型本地部署完整教程,通过LM Studio加载GGUF量化版本,仅需4G显存即可运行,并接入DeepSeek Hermes实现工具调用、文档翻译与联网搜索,附详细配置步骤与实测能力分析。

阅读全文 →
Ekko Studio + Jev:从判断环节给 Agent 减少等待
·4 分钟

Ekko Studio + Jev:从判断环节给 Agent 减少等待

Ekko Studio 与 Jev 组合通过优化工具调用、上下文压缩和内容总结的判断环节,减少 AI Agent 的无效等待。本文解析其分工设计、三大应用方向及必须认清的工程边界。

阅读全文 →