Unverified50% confidenceBenchmarkExact time
2024 年的多项基准测试表明,经过严格安全对齐的模型在代码生成任务上的拒绝率比基座模型高出 15-30%,在创意写作任务上的自我审查率高达 40%
1
Sources
50%
Confidence
Long-term
Relevance
8/22/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedAnthropic在2024年的研究论文中量化了模型过度拒绝现象,发现经过安全训练的模型在某些场景下拒绝率高达15-30%属于误判74% similarUnverified研究表明高质量提示词相比随意撰写的提示词在同等模型条件下可带来20%-40%的任务完成率提升73% similarUnverified推测解码中当草稿通过率低于50%时,实际加速效果会大打折扣甚至产生负优化73% similarUnverified斯坦福大学2023年的研究显示,Copilot在安全敏感代码场景下的错误率高达40%72% similarUnverified研究表明,结构化的Prompt相比随意描述,可将代码生成的首次通过率从30%提升至70%以上71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/786981API
curl https://kongchang.com/api/v1/knowledge/claims/786981MCP
get_claim(id=786981)