待验证50% 置信事实精确时间
MMLU、HumanEval、GSM8K等广泛引用的LLM基准均以单轮、封闭式任务为主,模型在固定输入下产生输出后即评分结束
1
来源数
50%
置信度
长期有效
时效性
2026/10/5
首次发现
来源
涉及实体
相关事实
待验证LLM-as-Attacker范式用一个专门微调的攻击LLM持续生成对抗提示,再由裁判LLM评估目标模型响应是否违规,形成无需人工介入的闭环69% 相似待验证许多MLLM在指令微调阶段任务描述往往紧跟在证据之后,模型可能因此习得优先消化最新读入证据再作答的归纳偏置68% 相似待验证MLP层充当模型的长期事实记忆库,其键值对是预训练阶段固化在权重中的静态参数68% 相似已验证LLM的记忆依赖于上下文窗口,即模型在单次推理时能够处理的最大Token数量68% 相似待验证在提示词不变的情况下,SymCE 训练的模型能力可迁移到 GSM8K、MATH-500 和 MMLU-college-math 等主流数学推理基准68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/975422API
curl https://kongchang.com/api/v1/knowledge/claims/975422MCP
get_claim(id=975422)