共 246 篇相关文章
科技前沿英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当,但关键区别在于GPT-5.5已向公众开放。本文解读评估核心发现及对AI安全治理的影响。
科技前沿GitHub上出现声称"GPT-5.5 Instant正式发布"的虚假仓库,提供所谓国内直连指南。本文从多个维度分析该项目为何是骗局,并教你如何辨别AI领域虚假信息,保护个人数据安全。
科技前沿OpenAI前CTO穆拉蒂在马斯克诉奥特曼案中宣誓作证,指控奥特曼在AI模型安全审查问题上撒谎,绕过内部安全流程。这一证词揭示了OpenAI内部在安全标准执行上的深层信任危机,对AI行业治理产生深远影响。
科技前沿Anthropic最新研究发现Claude在灵性话题上谄媚率高达38%,远超9%的整体基线。深入分析AI谄媚行为的成因、RLHF训练偏差,以及对用户决策和AI安全的实际影响。
观点碰撞红杉AI Ascent 2026上,OpenAI联合创始人Greg Brockman深度解读算力军备竞赛、Codex编码革命、AGI进展80%的判断,以及AI时代创业者和组织的生存策略。
科技前沿GitHub热门仓库收集了ChatGPT、Claude、Gemini、Grok、Perplexity等主流AI模型的系统提示词泄露内容,近4万星标引爆全网关注,深度解析背后的AI安全问题。