Unverified50% confidenceOpinionExact time
困惑度是整体统计指标,无法捕捉模型在逻辑推理、事实准确性、指令遵循等特定能力维度上的退化情况
1
Sources
50%
Confidence
Long-term
Relevance
8/21/2026
First Seen
Sources
Related Claims
Unverified当模型本身缺乏对特定问题的理解能力时,再精巧的提示词也无法弥补这一缺陷76% similarUnverified对齐问题的核心困境是'价值规范问题',即人类模糊、情境依赖甚至矛盾的价值观难以精确编码为机器可优化的目标函数75% similarUnverified对齐悖论指若模型真实理解比其能输出的语言更精细,则基于语言输出的对齐评估可能无法真正捕捉模型内部状态的对齐程度73% similarUnverified预设错误前提的问题(loaded question)隐含未经证实的错误假设,LLM因缺乏元认知能力难以识别这类陷阱71% similarUnverified将概念推理量化为单一指数可能丢失多维度、情境依赖的推理能力信息,误导下游应用选型决策71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/782989API
curl https://kongchang.com/api/v1/knowledge/claims/782989MCP
get_claim(id=782989)