待验证50% 置信权衡取舍精确时间
与传统的模型预测控制(MPC)或ZMP方法相比,强化学习策略无需显式建模动力学方程,能够通过海量试错自动发现高效的运动模式
1
来源数
50%
置信度
长期有效
时效性
2026/9/7
首次发现
来源
涉及实体
引用此条事实
Stable URI
https://kongchang.com/claim/870195API
curl https://kongchang.com/api/v1/knowledge/claims/870195MCP
get_claim(id=870195)