Unverified50% confidenceBenchmarkExact time
消融分析显示片段范式微调在测试集带来+5.29分提升,而用2000检索词替换前4500转录词仅带来+1.55分提升
1
Sources
50%
Confidence
Long-term
Relevance
9/23/2026
First Seen
Sources
Related Claims
Unverified测试损失与计算量之间的幂律指数约为0.05,意味着计算量每增加10倍,模型性能提升约12%73% similarUnverified在新闻分类任务上,少样本提示平均获得+24个百分点的提升;在法律文本任务上提升幅度仅为+3.4个百分点,其中两个模型表现出现退化72% similarUnverified题量并非越多越好:低于60题的测评难以覆盖多维度、信度不足;但超过300题会因答题疲劳导致后半段数据质量下降。个人自测选100-150题、20分钟内完成的版本较为均衡71% similarUnverified推测解码中当草稿通过率低于50%时,实际加速效果会大打折扣甚至产生负优化70% similarUnverified微调后的DistilBERT在同分布测试中F1=0.9993,但在主题偏移下损失12.9个平均精度点,退化比线性模型的5.2点更严重69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/942878API
curl https://kongchang.com/api/v1/knowledge/claims/942878MCP
get_claim(id=942878)