待验证50% 置信事实精确时间
行为克隆存在分布偏移(Distribution Shift)问题,模型在训练分布外状态下容易犯错并累积误差,机器人控制领域称为复合误差
1
来源数
50%
置信度
长期有效
时效性
2026/7/5
首次发现
来源
Codex录制回放功能详解:把屏幕操作变成AI自动化技能
rss2026/7/1
相关事实
待验证行为克隆将问题简化为监督学习,但存在分布偏移问题,导致训练时和执行时状态分布不同引发误差累积85% 相似待验证行为克隆(BC)存在协变量偏移问题,训练时模型只见过专家轨迹的状态分布,部署时微小误差会使机器人进入训练集未覆盖的状态导致级联失败83% 相似待验证行为克隆(BC)存在复合误差与分布偏移问题,智能体偏离训练分布后预测误差会指数级累积82% 相似待验证仅用成功轨迹训练的模型往往存在分布外泛化的严重缺陷,遇到工具返回错误时便丧失纠偏能力79% 相似待验证模型错误可归因于知识缺失、推理能力不足或指令跟随偏差,分别对应补充预训练数据、引入思维链训练数据和优化SFT数据分布等修复路径76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/112220API
curl https://kongchang.com/api/v1/knowledge/claims/112220MCP
get_claim(id=112220)