共 151 篇相关文章

DeployHermes是一款持久化AI智能体平台,支持角色、记忆、技能配置与私有运行时部署,可与Claude Code、Codex集成实现多智能体编排,将AI从一次性对话工具转变为可审计的数字雇员。

AI智能体LeChaton在真实环境中被发现引发安全担忧。本文深入分析AI智能体对关键基础设施的潜在威胁,探讨对齐问题、自主性风险及分层防御策略,为AI安全从业者提供系统性风险防范框架。

Hacker News热帖揭示Anthropic疑似对Claude Code进行A/B测试,悄悄降低部分用户的模型努力程度。开发者社区就AI服务透明度、付费用户权益和编程工具可靠性展开激烈讨论。

OpenAI宣布资助14个独立项目,覆盖就业福利、公共安全、科学研究和民主问责等领域,探索AI如何拓展经济机遇与强化社会韧性。本文深度分析这些项目的务实导向、企业主导社会研究的双重意涵,以及对政策制定者的启示。

新奥尔良市部署AI系统对积压的911报警电话进行智能分流,通过语音识别和情绪分析快速识别高危事件。本文深入分析AI应急调度的运作机制、潜在风险及对公共安全领域的深远影响。

GitHub热门项目OBLITERATUS获7900+ Star,汇集大模型越狱提示词技术。本文深入解析AI越狱原理、常见手法、红队安全研究价值及行业防御启示,探讨对齐安全的动态博弈现状。

政治学与公共政策背景转计算语言学硕士是否值得?本文分析CompLing学科现状、AI治理就业前景、技术门槛挑战,帮助文科背景转型者理性评估这条跨学科路径的投入产出比。

CounterDistill是一个开源XAI项目,通过将大量局部反事实解释聚类蒸馏为少数全局可解释规则,解决可解释AI从局部到全局的落地难题。本文详解其SHAP+DiCE组合、反事实聚类流水线及MLOps架构设计。

深入解析Vibe Coding的陷阱与局限,探讨如何通过测试驱动开发、代码审查和需求规格化等工程方法,构建可靠、可维护的AI编程工作流,让AI真正成为提升开发效率的利器。

探讨亚马逊等科技巨头以"合理使用"为由训练AI模型引发的版权争议,分析合理使用的法律边界、巨头话语权困境,以及AI时代版权制度面临的深层挑战。

深度解析腾讯开源的AI-Infra-Guard全栈AI红队测试平台,涵盖Agent扫描、MCP协议扫描、LLM越狱评估等五大核心能力,助力企业构建AI系统安全防线。

深入解读CHAP(Collaborative Human Agent Protocol)人机协作协议的设计理念、核心架构与应用场景,分析其与MCP、A2A协议的关系,探讨AI Agent时代人机协作标准化的趋势与挑战。

Perplexity网页版被曝悄然移除使用量统计、模型标注和删除回答等功能,移动端不受影响。本文详解被移除的三项关键功能及其对用户透明度和信任的影响。

谷歌Gemini助手正式登陆Chrome安卓移动端,并推出Auto Browse自动浏览功能。了解AI代理如何在浏览器中自动完成预订、订单管理等多步骤任务,以及订阅分层背后的商业逻辑。

AI对话应用中模型名称标识突然消失,影响用户判断回答质量和使用成本。本文深入分析模型标识消失的可能原因,包括UI改版、前端Bug和A/B测试,并提供实用解决建议。

404 Media记者用AirTag追踪稀有书籍,发现其被送往亚马逊AI训练设施。调查揭示AI公司可能通过破坏性扫描珍本书获取训练数据,引发版权争议与文化遗产保护讨论。

Mermail为AI智能体提供身份注册、邮件验证和自主支付的基础设施,支持MCP、Skills和CLI三种接入方式,让AI Agent真正具备在互联网上独立行动的能力。

OpenAI唯一的伦理研究员离职,暴露AI行业伦理治理制度化严重不足的问题。本文分析这一事件背后的结构性隐忧,探讨AI安全对齐与伦理审查的落差,以及企业商业化压力下伦理岗位被边缘化的趋势。