待验证75% 置信事实时间未知
GPT-5.1 Pro在DEF CON Goldbug密码挑战赛测试中,用约30分钟思考时间正确识别了ADFGX密码,而没有任何Claude模型能做到这一点
1
来源数
75%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
GPT-5.1 Pro深度评测:最聪明的AI困在最烂的界面里
bilibili安得广厦千万间678
涉及实体
相关事实
待验证GPT-5.1 Pro经过约40分钟总计算时间,最终正确解出了Smuggler's Manifest密码谜题,答案为'WALLET PICKER'74% 相似待验证GPT-5.5 Pro在22分钟内输出了一份逻辑自洽的埃尔多斯710号问题证明,但实际上是在重述几十年前已被证实的旧结论66% 相似待验证GPT-5.5在OS World Verified基准测试上略逊于Claude尚未发布的新模型63% 相似待验证GPT-4能够在CTF竞赛中解决中等难度的二进制利用题目,而GPT-3几乎无法完成完整的漏洞利用开发62% 相似待验证GPT-5.2 Pro在深度推理测试中思考时间长达14分钟61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/12474API
curl https://kongchang.com/api/v1/knowledge/claims/12474MCP
get_claim(id=12474)