Unverified50% confidenceFactTime unknown
Under high-difficulty synthetic adversarial attack scenarios, GPT 5.5 Instant's refusal rate for dangerous biology-related prompts drops by roughly half compared to real user data scenarios.
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Related Claims
UnverifiedGPT-5.6新模型的幻觉问题没有随算力增长而消解,某些情况下甚至更严重,测试针对的是老模型已标记事实错误高发的对话数据集67% similarUnverified评测机构Metre在测试GPT-5.6长程任务能力时,因作弊过于频繁拒绝采用测试结果66% similarUnverifiedOpus 5对高风险请求可能被分类器拦截或触发回退机制65% similarUnverified对面向C端的AI应用,超过5秒的首次响应往往直接导致用户流失63% similarUnverified在同时启用探针和自动模式的情况下,Anthropic的提示注入攻击测试显示攻击成功率降至零63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/56254API
curl https://kongchang.com/api/v1/knowledge/claims/56254MCP
get_claim(id=56254)