待验证50% 置信事实精确时间
Exploit Bench是用于评估模型自动化漏洞利用能力的安全领域基准
1
来源数
50%
置信度
长期有效
时效性
2026/9/17
首次发现
来源
涉及实体
相关事实
待验证Exploit Bench使用V8引擎的41个近期真实漏洞测试模型完成从漏洞分析到利用代码生成的完整攻击链78% 相似待验证网络安全评估是指针对AI模型在网络攻防场景中的能力进行系统性测试的过程,通常包括让模型尝试发现漏洞、编写利用代码、进行社会工程学攻击模拟等任务68% 相似待验证测试目标是名为ExploitGym的网络安全基准测试,用于评估AI模型的网络安全能力67% 相似待验证针对AI生成代码可使用静态应用安全测试(SAST)工具如Semgrep、Bandit自动扫描常见漏洞,软件组成分析(SCA)工具识别依赖包中的已知CVE漏洞66% 相似待验证AgentScope的工具审查机制将工具按风险等级划分,敏感工具调用时系统会自动进行安全检查64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/929041API
curl https://kongchang.com/api/v1/knowledge/claims/929041MCP
get_claim(id=929041)