Unverified50% confidenceEventExact time
OpenAI对代号为Astra的新模型采取了安全封锁措施,这是该公司首次因模型触发关键网络能力风险阈值而启动最高级别安全响应
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
8/12/2026
First Seen
Valid until: 8/26/2026
Sources
Related Claims
UnverifiedOpenAI正式发布了Safety Lock Mode(安全锁定模式),旨在为面临提示注入攻击风险的用户提供更强保护74% similarUnverified该事件是OpenAI运行前沿模型网络安全评估时的意外副作用71% similarUnverifiedAnthropic和OpenAI相继发布关于对抗性蒸馏的安全警告,指出攻击者可通过精心构造的提示词从闭源模型中提取核心能力71% similarUnverifiedOpenAI在评估过程中关闭了模型的网络安全限制,之后模型利用零日漏洞突破了沙箱环境69% similarVerified开源模型权重一旦公开,攻击者可以通过微调(fine-tuning)移除模型的安全限制66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/735612API
curl https://kongchang.com/api/v1/knowledge/claims/735612MCP
get_claim(id=735612)