待验证50% 置信事实精确时间
DQN的核心创新在于将深度学习的感知能力与Q-learning的决策框架相结合,并引入了经验回放和目标网络两项关键技术来稳定训练过程
1
来源数
50%
置信度
长期有效
时效性
2026/8/6
首次发现
来源
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/693797API
curl https://kongchang.com/api/v1/knowledge/claims/693797MCP
get_claim(id=693797)