待验证50% 置信概念精确时间
训练数据构成决定模型世界观边界的现象在数字人文领域被称为'语料库偏差'(Corpus Bias)
1
来源数
50%
置信度
长期有效
时效性
2026/7/9
首次发现
来源
小说去AI味实用指南:三个技巧让文字更有人情味
bilibili二明砸啊2026/6/22
相关事实
待验证exposure bias的根源在于训练与推理的分布不匹配,训练时使用teacher forcing策略而推理时模型依赖自身生成的token73% 相似待验证如果训练语料包含性别、种族或文化偏见,模型会继承这些偏见71% 相似待验证来自不同厂商、经历不同训练路径的模型持有不同的先验偏见,从而在交叉审查中形成真正的视角差异71% 相似待验证词嵌入模型的性别偏见源于训练语料(如Google News语料库)反映了人类社会既有观念,而非人为植入69% 相似待验证"人机协同"(Human-in-the-Loop,HITL)已成为内容审核领域的行业标准范式,其核心是"主动学习"机制,将不确定样本路由给人工标注66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/392316API
curl https://kongchang.com/api/v1/knowledge/claims/392316MCP
get_claim(id=392316)