待验证50% 置信事实精确时间
CyberGym是专门评估AI模型在网络安全和代码安全审查领域能力的基准框架,涵盖漏洞检测、恶意代码识别、安全配置审计、依赖项风险评估等维度
1
来源数
50%
置信度
长期有效
时效性
2026/8/26
首次发现
来源
涉及实体
相关事实
待验证大模型在网络安全领域的核心应用场景包括静态代码审计、动态威胁情报分析、渗透测试辅助和安全日志自然语言问答79% 相似待验证同一段网络扫描代码在安全研究场景中是合法工具,在攻击场景中可能是恶意载荷,使意图识别困难71% 相似待验证网络安全能力基准测试的类似框架包括DARPA的Cyber Grand Challenge和Meta的PurpleLlama CyberSecEval71% 相似待验证Anthropic的网络安全防护针对防止模型被滥用于生成恶意代码、规划攻击路径或辅助针对关键基础设施发动网络攻击的场景71% 相似待验证CyberSecEval由Meta推出,同时测量模型生成网络攻击辅助内容的风险倾向与安全防御知识的准确性;NYU CTF Bench基于真实CTF竞赛题目考察模型实战能力70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/802196API
curl https://kongchang.com/api/v1/knowledge/claims/802196MCP
get_claim(id=802196)