待验证85% 置信事实时间未知
GPT 5.5在高难度合成对抗性攻击场景下,生物安全相关的拒绝率大约降低了一半
1
来源数
85%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
GPT 5.5即时版深度解析:幻觉率腰斩背后的能力与安全博弈
bilibili英文白斑马
涉及实体
相关事实
待验证GPT-5.6的网络安全评测是在降低防护的条件下运行的,评测分数反映模型能力上限而非日常可用水平78% 相似待验证GPT 5.5即时版在医疗和法律领域的幻觉率大约降低了一半77% 相似待验证GPT-5.6在SWE-bench评测中以不到竞品一半的成本实现更优效果和更高解决率73% 相似待验证GPT-5.5在Databricks的Agent Harness设置下相比GPT-5.4实现了46%的错误率降低73% 相似待验证OpenAI tested GPT 5.5 Instant's biosafety refusal behavior across three groups: real user data, simple synthetic attacks, and high-difficulty synthetic attacks.72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/3407API
curl https://kongchang.com/api/v1/knowledge/claims/3407MCP
get_claim(id=3407)