已验证65% 置信事实精确时间
机器人运动控制常用PPO(近端策略优化)或SAC(软演员-评论家)等算法
3
来源数
65%
置信度
长期有效
时效性
2026/8/9
首次发现
来源
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/714073API
curl https://kongchang.com/api/v1/knowledge/claims/714073MCP
get_claim(id=714073)https://kongchang.com/claim/714073curl https://kongchang.com/api/v1/knowledge/claims/714073get_claim(id=714073)