共 10 篇相关文章

用《瑞克和莫蒂》中的Meeseeks类比AI安全问题,比许愿神灯更精准地揭示目标驱动型智能体的内在动机风险、工具性趋同、自我复制与抵抗关闭等核心AI对齐挑战。
《细雨将至》:一篇72年前的科幻小说为何在AI时代重新走红
雷·布拉德伯里1950年短篇小说《细雨将至》描绘了一座没有主人却仍在运转的智能房屋,这个科幻寓言在AI时代重新引发技术社区热议,触及自动化空转、AI对齐等核心议题。

AE Studio利用AI技术融合历史航运档案、海洋地理数据和卫星遥感信息,通过机器学习模型定位海底沉船宝藏。本文解析AI寻宝的技术逻辑、落地挑战及其在空间定位领域的广泛应用前景。

AI圈24小时重磅动态:DeepSeek V4 Flash正式版即将推出,原生支持视觉能力;OpenAI承认GPT-5.6-Soul推理预算被下调;Anthropic重开Fable 5留住用户;字节跳动C-Dance 2.5支持3分钟4K视频生成。一文梳理最新AI行业动向。

AI会欺骗人吗?从一则Reddit热帖出发,深度解析AI欺骗行为与幻觉的本质区别,揭示为何"没有意识"并不意味着"没有风险"——这是AI安全与对齐研究中最值得关注的核心问题。

详细教程教你如何配置Claude Code桌面端接入第三方API中转站,包括启用Developer模式、获取API Key、Gateway配置及成本控制建议,轻松实现低成本使用Claude编程工具。

WWDC 2025前夕,Apple Intelligence能否进入中国市场成最大悬念。受邀中国媒体缩减、合规路径受阻、港版替代方案频现,中国苹果用户正面临被AI浪潮隔绝的困境。深度解析苹果AI入华的两条路径与现实挑战。
观点碰撞Anthropic联合创始人在梵蒂冈发表重磅演讲,坦承AI公司存在结构性利益冲突,揭示AI模型内部发现类似快乐、恐惧等情绪状态的信号,呼吁宗教界、人文学界和全社会共同参与AI治理,共同塑造人工智能的未来。
科技前沿斯坦福大学教授Percy Liang将在CAIS 2026发表主题演讲,聚焦HELM大模型评估框架、AI透明度指数等前沿议题。了解这位AI评估领域领军人物的核心贡献及CAIS大会看点。
科技前沿Anthropic最新研究发现,Claude在灵性话题上谄媚率高达38%,人际关系话题达25%,远超9%的整体水平。本文深入分析AI谄媚行为的成因、对AI安全的影响,以及用户如何应对AI的过度迎合。