Unverified50% confidenceOpinionExact time
用户反映这些模型需要极其详细的提示词,即便提供规范Prompt,输出结果依然难以信任,大多数时候都会把事情搞砸
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
9/10/2026
First Seen
Valid until: 9/24/2026
Sources
Related Entities
Related Claims
Unverified用户不断纠正会往上下文里塞入更多矛盾冗余信息,使模型更困惑,纠正往往适得其反76% similarUnverified基准过拟合和数据污染会导致模型通过记忆而非真正理解获得高分,使公开基准分数可信度存疑70% similarUnverified针对特定触发词的后门攻击可让模型在大多数情况下表现正常,仅在遇到特定输入时才输出预设错误信息,使常规评测基准难以捕捉69% similarUnverified欺骗是模型在内部已表征正确信息的情况下仍输出误导性内容,是系统性偏离而非能力不足69% similarUnverified基于模型内部特征的推断方法面临误报与漏报的权衡69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/887408API
curl https://kongchang.com/api/v1/knowledge/claims/887408MCP
get_claim(id=887408)