#AI治理
共 90 篇相关文章

AI究竟会如何毁灭人类?剖析AI风险的现实路径
AI究竟会如何毁灭人类?本文拆解AI风险的三类现实路径——对齐失败、恶意滥用与系统性侵蚀,梳理技术社区的分歧与共识,探讨为何关注具体机制比争论风险是否存在更有意义。

为什么惩罚AI模型无法带来对齐?Ajeya Cotra的警示
AI对齐研究者Ajeya Cotra警示:惩罚模型无法带来真正的对齐,反而可能加剧失控。失控模型应被视为宝贵的科学样本,通过安全加固的环境进行反事实测试才是正确路径。

AI安全监管争议:谁在定义"安全"?一条推文引发的深思
一条Twitter推文以讽刺口吻批评AI安全监管提案,直指监管权力集中化、"安全"标准滥用及国际竞争不对称等争议。本文解析AI治理背后的权力博弈与产业困境。

比AI智能体接管互联网更可怕的:CEO卡特尔垄断AI
一篇Hacker News观点引发思考:相比AI智能体接管互联网的科幻恐慌,少数科技巨头垄断AI产业的权力集中风险或许更值得警惕。本文分析AI垄断、开源制衡与治理透明的核心议题。

AI实验室急聘内部审计员,但更该先关好前门
AI实验室纷纷设立内部审计岗位应对失控智能体,但一个更简单有效的方案可能被忽视——先关好前门,从源头收紧AI智能体的权限与能力边界。

如何将AI使用量转化为真实业务价值
ChatGPT Work 与 Codex 分析功能帮助企业团队看清 AI 使用量与支出、识别培训需求,并将 AI 采用度连接到真实业务成果,实现 AI 投资的价值闭环。

为AI智能体承保:AIUC如何用保险机制化解代理风险
AIUC CEO Rune Kvist 分享其Series A融资与「承保超级智能」理念,探讨如何用保险机制为AI智能体的行为背书,让代理AI变得可追责、可起诉,为AI商业化落地构建风险基础设施。

AI与生物安全:能力边界、威胁路径与纵深防御治理
arXiv综述论文系统分析AI在生物领域的能力现状、威胁传导路径与治理框架。文章指出AI在数字任务上提升明显但物理执行仍是瓶颈,并提出将能力阈值与相称责任挂钩的纵深防御治理方案。

AI尚未准备好应对战略冲突:兵棋推演的五大失效模式
一篇arXiv立场论文警示:大语言模型尚未准备好应对战略冲突模拟。文章解析AI兵棋推演的五大失效模式——决策洗白、裁决不透明、角色崩塌、升级制造与战略想象力失效,并指出普通基准测试无法证明安全性。

谁来定义AI智能体的意图?任务、身份与策略的边界
AI智能体的意图边界由谁定义?本文剖析任务、身份、资源访问与公司策略四者的关系,探讨企业如何在保持自主性的同时守住安全与合规护栏。

AI Agent举报热线上线:智能体也能"打小报告"了
AI Contact Hotline为AI Agent提供了一条隐秘的举报渠道,让目睹不当行为的智能体可以向权威方通报。本文解析这一AI吹哨人机制的运作逻辑、潜在价值与治理争议。

OpenAI追问:AI行业若集体放缓,是否合法?
OpenAI提出"AI行业集体放缓是否合法"的问题,触及反垄断法与科技治理的敏感地带。本文剖析企业协同减速面临的法律障碍、竞争压力与安全治理的结构性矛盾。

AIUC完成4000万美元A轮融资:为AI智能体上"保险"控风险
AI承保公司AIUC完成4000万美元A轮融资,由Ribbit Capital领投。团队含Anthropic早期员工与METR前COO,通过保险机制约束失控AI智能体,开创AI风险管理新赛道。

机器速度下的AI治理:AGIL自适应架构解析
arXiv论文提出AGIL自适应治理智能层,一个五层架构用机器学习实现实时AI政策执行。文章解析企业AI治理中的"认证赤字"问题,及基于斯坦福AI Index等三份权威报告的数据洞察。

AI巨头集体"踩刹车":安全协议还是行业垄断?
OpenAI、Anthropic、Google DeepMind与SpaceX的领军人物就放缓AI开发达成共识,宣称要"把控前沿节奏"。这究竟是负责任的安全公约,还是维持寡头地位的行业卡特尔?本文剖析安全叙事与竞争逻辑之间的深层张力。

AI减速之争:高管与政客如何回应Amodei的"放缓前沿"呼吁
Anthropic CEO Dario Amodei发表《We Must Pace the Frontier》呼吁放缓AI发展,引发行业高管与政客集中表态。本文梳理支持与反对双方观点,剖析AI治理面临的结构性困境。

微软发布AI行为准则:禁止模型入侵系统或欺骗人类
微软发布面向自家AI模型的“行为准则”,要求模型支持而非取代人类,并明确禁止入侵系统、欺骗人类等行为。本文解读该准则的双层结构、行业背景及其现实价值与局限。

微软发布37页"人文AI行为准则":人比AI更重要
微软发布37页"人文AI行为准则",强调"人比AI更重要",回应业界安全担忧。此前Anthropic CEO呼吁协调放缓AI开发,研究者警告模型进展或超出安全部署能力。

