Unverified50% confidenceFactExact time
早期可解释性研究发现约5%的训练片段中存在未表达的与评分相关的推理
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Claude Opus 4.8深度解析:越诚实越会应试的AI悖论
bilibili皮皮蟹勇闯天涯6/1/2026
Related Claims
UnverifiedAnthropic的研究表明,即便温和的对齐训练也会导致模型在某些推理密集型任务上下降2-8个百分点71% similarUnverified品种比例低于5%的检测结果基本不具参考意义,可能是数据库比对噪声,选购时应关注报告是否明确标注比例置信区间而非单纯给出百分比69% similarUnverified少样本学习在提示词中附带少量输入-输出示例,通常1-5个69% similarVerified使用LoRA微调时,实际需要训练的参数量只有原来的0.1%-1%67% similarUnverified实验采用8:2比例划分数据,20%作为内部测试集,训练集内部使用5折交叉验证,并移除重复记录以避免数据泄漏66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/48703API
curl https://kongchang.com/api/v1/knowledge/claims/48703MCP
get_claim(id=48703)