模型Deep Q-Network / DQN算法
DQN
DeepMind于2013年提出的深度强化学习算法,首次将深度神经网络与Q-learning结合,引入经验回放机制
时间轴 (近 90 天)
8月23日
经验回放最早在DeepMind的DQN算法中被提出,智能体将过去的交互经验存储在缓冲区中,训练时随机采样以提高样本利用效率
待验证50%
DeepMind于2013年提出的深度强化学习算法,首次将深度神经网络与Q-learning结合,引入经验回放机制
经验回放最早在DeepMind的DQN算法中被提出,智能体将过去的交互经验存储在缓冲区中,训练时随机采样以提高样本利用效率