Unverified50% confidenceBenchmarkExact time
因果探针在不同模型上实现了17%–118%的引导能力提升,而概念检测能力仅下降3%
1
Sources
50%
Confidence
Long-term
Relevance
10/7/2026
First Seen
Sources
Related Entities
Related Claims
Unverified7个通过替代测试的模型变化率为15.9%,而6个未通过的模型高达25.8%,性能更好的模型受干扰程度较低但仍高于提示词修改影响75% similarUnverified研究团队指出推理时上下文管理在基准测试中带来的提升幅度超过了大多数已报告的系统间差异74% similarUnverified靶向数据工程中,针对性数据占总微调数据的 5%-15% 通常能取得良好效果,过高比例可能导致模型在其他维度退化72% similarUnverified研究人员发现,仅将函数描述中的retrieve替换为fetch,在某些模型上会导致调用成功率下降约15%71% similarUnverifiedAnthropic的研究表明,即便温和的对齐训练也会导致模型在某些推理密集型任务上下降2-8个百分点70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/982948API
curl https://kongchang.com/api/v1/knowledge/claims/982948MCP
get_claim(id=982948)