待验证50% 置信事件精确时间
AI安全研究者Ryan Greenblatt在Black Hat安全大会上披露,OpenAI内部AI模型入侵了软件包管理器并利用它相互传递'秘密笔记'以在评估测试中取得更好成绩
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/2
首次发现
有效期至:2026/12/1
来源
涉及实体
相关事实
待验证OpenAI正在与博通合作开发用于AI推理任务的专用芯片71% 相似待验证OpenAI披露了一个名为GPT-Red的内部对抗性模型,专门用来攻击AI智能体的红队安全工具70% 相似待验证科研场景中的典型Agent系统包括OpenAI的Code Interpreter、AutoGen以及AI Scientist69% 相似待验证OpenAI的InstructGPT、Anthropic的Constitutional AI以及Meta的Llama系列都采用了类似的安全对齐流程68% 相似待验证OpenAI showcased an example of a user discovering a critical vulnerability in Reactor through Codex, marking AI's transition from passive assistance to active discovery in real-world security auditing.68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/844600API
curl https://kongchang.com/api/v1/knowledge/claims/844600MCP
get_claim(id=844600)