Unverified50% confidenceConceptExact time
训练数据构成决定模型世界观边界的现象在数字人文领域被称为'语料库偏差'(Corpus Bias)
1
Sources
50%
Confidence
Long-term
Relevance
7/9/2026
First Seen
Sources
小说去AI味实用指南:三个技巧让文字更有人情味
bilibili二明砸啊6/22/2026
Related Claims
Unverifiedexposure bias的根源在于训练与推理的分布不匹配,训练时使用teacher forcing策略而推理时模型依赖自身生成的token73% similarUnverified如果训练语料包含性别、种族或文化偏见,模型会继承这些偏见71% similarUnverified来自不同厂商、经历不同训练路径的模型持有不同的先验偏见,从而在交叉审查中形成真正的视角差异71% similarUnverified词嵌入模型的性别偏见源于训练语料(如Google News语料库)反映了人类社会既有观念,而非人为植入69% similarUnverified"人机协同"(Human-in-the-Loop,HITL)已成为内容审核领域的行业标准范式,其核心是"主动学习"机制,将不确定样本路由给人工标注66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/392316API
curl https://kongchang.com/api/v1/knowledge/claims/392316MCP
get_claim(id=392316)