Unverified50% confidenceFactExact time
语言模型输出的每个 token 的负对数概率之和是对序列的编码长度估计,这是困惑度指标的由来
1
Sources
50%
Confidence
Long-term
Relevance
9/22/2026
First Seen
Sources
Related Entities
Related Claims
Unverified困惑度是测试集上每个token平均负对数似然的指数,值越低代表模型对语料的预测越准确75% similarUnverified同一段文字在不同模型中消耗的 token 数量可能相差 10%-30%69% similarUnverified文法约束采样在模型生成每个token前将非法token的logit值设为负无穷,使其softmax后概率归零,从而保证输出100%符合语法67% similarUnverifiedword2vec负采样中,对每个正样本随机采样k个(通常5-20个)负样本,采样概率通常按词频的3/4次方分布66% similarUnverified在需求分析阶段回答AI越详细,最终出Bug的概率越低;修复需求阶段错误的成本仅为编码阶段发现同类错误的1/10到1/10066% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/940782API
curl https://kongchang.com/api/v1/knowledge/claims/940782MCP
get_claim(id=940782)