#AI可靠性
共 3 篇相关文章

·5 分钟
多智能体群体为何会集体陷入错误信念?
多智能体系统中,由LLM驱动的AI智能体群体为何会集体收敛到错误信念?本文借鉴《大众幻想与群众性疯狂》,剖析同质化偏见、相互影响与缺乏外部校验如何导致多智能体错觉,并探讨相应的系统设计启示。
阅读全文 →

·5 分钟
被说服而非被告知:AI如何被利益偏见证词骗过
arXiv新研究揭示语言模型代理的系统性失效:面对CRM中带利益偏见的销售证词,AI会把断言当证据通过本应否决的交易,七个主流模型被误导率高达87%-97%,模型规模和推理能力均无法抵抗。
阅读全文 →

·5 分钟
智能体工具交互的静默失败:ToolUniverse审计研究
arXiv最新研究揭示智能体工具交互中的「静默失败」:工具调用看似成功,信息却悄然缺失。通过审计ToolUniverse中的15个科学工具,发现91个失败案例,多数集中在API与封装层,并提出情境可靠性框架应对。
阅读全文 →