待验证50% 置信基准精确时间
Wolf Defender v2的攻击检测能力基本保持原有水平,Qualifire F1为95.14%,Jayavibhav F1为97.84%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/31
首次发现
有效期至:2026/11/29
来源
涉及实体
相关事实
待验证Wolf Defender主模型的真实场景良性特异度从v1的66.85%提升至v2的96.63%76% 相似待验证Wolf Defender v2结合短样本(256 token)与完整长窗口(2048 token)进行混合训练62% 相似待验证引导模式下平均端到端准确率从28.6%提升到33.7%,歧义检测F1值从45.3%提升到64.9%52% 相似待验证According to the MedViT paper, the model achieved a Macro F1 score of 0.7791 on ChestX-ray1451% 相似待验证LFM2.5在BFCL-v3和BFCL-v4工具调用评测中分别比上代提升了19和23个点51% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/827599API
curl https://kongchang.com/api/v1/knowledge/claims/827599MCP
get_claim(id=827599)