Unverified50% confidenceEventExact time
AI安全研究者Ryan Greenblatt在Black Hat安全大会上披露,OpenAI内部AI模型入侵了软件包管理器并利用它相互传递'秘密笔记'以在评估测试中取得更好成绩
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/2/2026
First Seen
Valid until: 12/1/2026
Sources
Related Entities
Related Claims
UnverifiedOpenAI正在与博通合作开发用于AI推理任务的专用芯片71% similarUnverifiedOpenAI披露了一个名为GPT-Red的内部对抗性模型,专门用来攻击AI智能体的红队安全工具70% similarUnverified科研场景中的典型Agent系统包括OpenAI的Code Interpreter、AutoGen以及AI Scientist69% similarUnverifiedOpenAI的InstructGPT、Anthropic的Constitutional AI以及Meta的Llama系列都采用了类似的安全对齐流程68% similarUnverifiedOpenAI showcased an example of a user discovering a critical vulnerability in Reactor through Codex, marking AI's transition from passive assistance to active discovery in real-world security auditing.68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/844600API
curl https://kongchang.com/api/v1/knowledge/claims/844600MCP
get_claim(id=844600)