[KongchangAI]
Unverified50% confidenceBenchmarkExact time

CyberSecEval由Meta推出,同时测量模型生成网络攻击辅助内容的风险倾向与安全防御知识的准确性;NYU CTF Bench基于真实CTF竞赛题目考察模型实战能力

1
Sources
50%
Confidence
Long-term
Relevance
7/11/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/477629
API
curl https://kongchang.com/api/v1/knowledge/claims/477629
MCP
get_claim(id=477629)