待验证50% 置信事实精确时间
CyberSecEval 是 Meta 发布的安全基准,用于评估模型在代码漏洞识别、CTF 解题和安全问答上的表现
1
来源数
50%
置信度
长期有效
时效性
2026/9/12
首次发现
来源
涉及实体
相关事实
待验证CyberSecEval由Meta推出,同时测量模型生成网络攻击辅助内容的风险倾向与安全防御知识的准确性;NYU CTF Bench基于真实CTF竞赛题目考察模型实战能力78% 相似待验证CyberGym是专门评估AI模型在网络安全和代码安全审查领域能力的基准框架,涵盖漏洞检测、恶意代码识别、安全配置审计、依赖项风险评估等维度76% 相似待验证网络安全能力基准测试的类似框架包括DARPA的Cyber Grand Challenge和Meta的PurpleLlama CyberSecEval73% 相似待验证评估模型安全能力的基准包括Meta推出的CyberSecEval和NYU CTF Bench70% 相似待验证CTF题目涵盖Web安全、逆向工程、密码学、二进制漏洞利用(Pwn)、杂项(Misc)等方向69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/913322API
curl https://kongchang.com/api/v1/knowledge/claims/913322MCP
get_claim(id=913322)