待验证50% 置信事实精确时间
语言模型输出的每个 token 的负对数概率之和是对序列的编码长度估计,这是困惑度指标的由来
1
来源数
50%
置信度
长期有效
时效性
2026/9/22
首次发现
来源
涉及实体
相关事实
待验证困惑度是测试集上每个token平均负对数似然的指数,值越低代表模型对语料的预测越准确75% 相似待验证同一段文字在不同模型中消耗的 token 数量可能相差 10%-30%69% 相似待验证文法约束采样在模型生成每个token前将非法token的logit值设为负无穷,使其softmax后概率归零,从而保证输出100%符合语法67% 相似待验证word2vec负采样中,对每个正样本随机采样k个(通常5-20个)负样本,采样概率通常按词频的3/4次方分布66% 相似待验证在需求分析阶段回答AI越详细,最终出Bug的概率越低;修复需求阶段错误的成本仅为编码阶段发现同类错误的1/10到1/10066% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/940782API
curl https://kongchang.com/api/v1/knowledge/claims/940782MCP
get_claim(id=940782)