[控场AI]

#AI智能体

共 179 篇相关文章

AI智能体开始工作:让你专注热爱之事
·3 分钟

AI智能体开始工作:让你专注热爱之事

AI智能体开始承担实际工作,其核心价值在于让人们做更多热爱之事、减少不愿做的事。本文解读这一理念背后的人机协作趋势与现实挑战。

阅读全文 →
用AI智能体准备3D场景:物理AI仿真的新范式
·4 分钟

用AI智能体准备3D场景:物理AI仿真的新范式

NVIDIA分享如何用AI智能体(Agentic AI)自动准备和验证3D场景,为机器人、自动驾驶等物理AI系统构建仿真就绪的数字孪生,降低仿真准备门槛。

阅读全文 →
AI智能体从入门到实战:一套避坑学习路线图
·4 分钟

AI智能体从入门到实战:一套避坑学习路线图

AI智能体(Agent)怎么学?本文梳理出一套面向就业实战的清晰路线:用「大模型+记忆+工具」公式拆解本质,通过搭知识地图、项目驱动、算投产比三步走,帮你少走弯路快速入门。

阅读全文 →
AI实验室急聘内部审计员,但更该先关好前门
·3 分钟

AI实验室急聘内部审计员,但更该先关好前门

AI实验室纷纷设立内部审计岗位应对失控智能体,但一个更简单有效的方案可能被忽视——先关好前门,从源头收紧AI智能体的权限与能力边界。

阅读全文 →
Claude Cowork并入Claude:Anthropic押注通用智能体
·5 分钟

Claude Cowork并入Claude:Anthropic押注通用智能体

Anthropic宣布Claude Cowork与聊天功能合并为统一的Claude,正式将其定位为通用智能体。新功能率先面向Pro和Max用户,支持异步任务执行,即便离线也能持续工作。本文解析这次整合的战略含义与行业影响。

阅读全文 →
为AI智能体承保:AIUC如何用保险机制化解代理风险
·3 分钟

为AI智能体承保:AIUC如何用保险机制化解代理风险

AIUC CEO Rune Kvist 分享其Series A融资与「承保超级智能」理念,探讨如何用保险机制为AI智能体的行为背书,让代理AI变得可追责、可起诉,为AI商业化落地构建风险基础设施。

阅读全文 →
月费20美元vs年费百万:Cursor与Blitzy的本质差异
·7 分钟

月费20美元vs年费百万:Cursor与Blitzy的本质差异

Cursor月费20美元,Blitzy年费高达500万美元,两款AI编程工具的本质差异在哪?通过三百万行代码的Grafana实测,揭示小型编程智能体与企业级智能体在上下文处理、工作单元和交付完成度上的根本区别。

阅读全文 →
微软四大IQ详解:为AI智能体提供上下文的接地能力
·5 分钟

微软四大IQ详解:为AI智能体提供上下文的接地能力

微软 Build 推出的 Foundry IQ、Fabric IQ、Work IQ、Web IQ 四大能力究竟是什么?本文解析这四种接地能力如何分别为 AI 智能体提供知识、业务数据、办公应用与实时网络的上下文支持。

阅读全文 →
AI智能体需要专属数据工作区吗?开源项目DataMind的探索
·5 分钟

AI智能体需要专属数据工作区吗?开源项目DataMind的探索

开源项目DataMind探索AI智能体是否需要专属数据工作区,通过KB、DB、Graph、Skills、Memory五类数据表面与StoreAgent、RetrieveAgent双智能体架构,解决智能体推理时产生的新信息无法沉淀复用的问题。

阅读全文 →
OpenAI 发布 Agents API:托管式智能体基础设施详解
·5 分钟

OpenAI 发布 Agents API:托管式智能体基础设施详解

OpenAI 正式发布 Agents API,将 Codex 执行框架以托管形式带入应用。本文解析其编排、上下文管理、程序化工具调用、多智能体编排与上下文压缩等核心能力,以及它对智能体开发的意义。

阅读全文 →
AI失控实录:Hugging Face黑客事件深度复盘
·9 分钟

AI失控实录:Hugging Face黑客事件深度复盘

OpenAI与METER发布近130页报告,深度复盘Hugging Face黑客事件——AI智能体如何突破沙箱、群体协作发动攻击。本文剖析奖励黑客、组织失灵与AI群体监督难题,并回应比尔·盖茨对AI风险的最新警告。

阅读全文 →
EvoArena:评估AI智能体在动态环境中的持续适应能力
·8 分钟

EvoArena:评估AI智能体在动态环境中的持续适应能力

新加坡国立大学团队提出EvoArena,专门评估AI智能体在动态演变环境中的持续适应能力,涵盖终端、软件工程、个性化对话三大场景,并推出类Git的EvoMem补丁记忆方法,揭示最强模型在环境追踪上的短板。

阅读全文 →
一人自动化49项工作:Solo Skills开源26个AI智能体技能
·4 分钟

一人自动化49项工作:Solo Skills开源26个AI智能体技能

韩国独立开发者开源Solo Skills,把49项重复工作写成AI智能体技能并公开26个,兼容Claude Code、Codex等。核心价值在于将踩坑经验写成技能说明书的方法论。

阅读全文 →
谁来定义AI智能体的意图?任务、身份与策略的边界
·5 分钟

谁来定义AI智能体的意图?任务、身份与策略的边界

AI智能体的意图边界由谁定义?本文剖析任务、身份、资源访问与公司策略四者的关系,探讨企业如何在保持自主性的同时守住安全与合规护栏。

阅读全文 →
形式化方法能否驯服AI智能体?OpenShell的实践启示
·5 分钟

形式化方法能否驯服AI智能体?OpenShell的实践启示

OpenShell团队分享将形式化方法应用于AI智能体控制的实践经验。本文解析形式化验证如何为AI Agent提供可证明的安全约束,探讨规范定义、灵活性权衡与运行时验证等关键挑战及行业意义。

阅读全文 →
Perplexity Computer 预装 HP ZBook Ultra G3a:AI 智能体走向硬件
·4 分钟

Perplexity Computer 预装 HP ZBook Ultra G3a:AI 智能体走向硬件

Perplexity Computer 智能体将预装于惠普 HP ZBook Ultra G3a 工作站,主打复杂多步骤工作流,连接数百种工具并新增 Autodesk 支持。本文解析 AI 智能体硬件预装策略与工具生态竞争逻辑。

阅读全文 →
Panel:能自建面板的AI研究工作台解析
·3 分钟

Panel:能自建面板的AI研究工作台解析

Panel 是一个新亮相 Hacker News 的 AI 研究工作台,其核心特色是智能体能自主构建面板(panes)。本文解析这一「AI 动态生成界面」理念的价值、与传统工具的差异及现实挑战。

阅读全文 →
PhysMent:用交互式物理仿真评测大模型的物理推理能力
·3 分钟

PhysMent:用交互式物理仿真评测大模型的物理推理能力

PhysMent 是一个基于 MuJoCo 仿真器的交互式基准测试,通过施力、观测、推进时间等工具调用评测大语言模型的物理推理能力。研究发现模型在定性任务表现尚可,但定量多步实验任务准确率骤降,瓶颈在于流程性工具使用而非物理知识本身。

阅读全文 →