Unverified60% confidenceFactTime unknown
同一个基座模型在不同系统提示词下的表现差异可以高达30-50个百分点
1
Sources
60%
Confidence
Long-term
Relevance
6/3/2026
First Seen
Sources
Hermes Agent自我进化机制深度解析:GIPA算法与工程实践
bilibili探索未至之境
Related Entities
Related Claims
UnverifiedResearch shows that the same base LLM model can vary by 30-50 percentage points in performance under different system prompts.79% similarUnverified同一套系统提示在不同模型上的效果差异可能超过30%,这是商业Harness需要针对每个模型单独维护提示版本的原因74% similarUnverified一个61分的模型和一个59分的模型在多数实际应用中的差异可能远小于分数暗示的程度73% similarUnverified在提示中包含具体评估维度(如格式、字数、覆盖要点、排除事项)比模糊提示平均可提升模型输出质量30%-50%72% similarPartially Verified研究表明,同一模型在不同提示词下的输出质量可能相差数倍70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/39640API
curl https://kongchang.com/api/v1/knowledge/claims/39640MCP
get_claim(id=39640)