Unverified50% confidenceFactExact time
预训练阶段的下一词预测目标让模型倾向生成自然流畅序列,而JSON等结构化格式在通用网络语料中占比有限,导致模型偶发格式违规
1
Sources
50%
Confidence
Long-term
Relevance
7/20/2026
First Seen
Sources
Related Claims
Unverified主流LLM的预训练采用下一个token预测作为目标,优化的是语言建模损失而非事实准确性75% similarUnverifiedHermes模型从微调阶段就大量使用结构化输出训练数据,使模型天然倾向于生成格式正确的JSON75% similarUnverified模型对 schema 的遵循能力受训练数据分布影响,训练语料中高频出现的字段组合会导致模型产生幻觉字段74% similarUnverified提示词工程通过角色定义、输出格式约束(如JSON Schema)、少样本示例等手段约束模型概率性输出74% similarVerified大语言模型的训练目标是预测下一个最可能出现的token,而非判断信息的真实性73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/572588API
curl https://kongchang.com/api/v1/knowledge/claims/572588MCP
get_claim(id=572588)