ModelDeep Q-Network / DQN算法
DQN
DeepMind于2013年提出的深度强化学习算法,首次将深度神经网络与Q-learning结合,引入经验回放机制
Timeline (last 90 days)
Aug 23
经验回放最早在DeepMind的DQN算法中被提出,智能体将过去的交互经验存储在缓冲区中,训练时随机采样以提高样本利用效率
Unverified50%
DeepMind于2013年提出的深度强化学习算法,首次将深度神经网络与Q-learning结合,引入经验回放机制
经验回放最早在DeepMind的DQN算法中被提出,智能体将过去的交互经验存储在缓冲区中,训练时随机采样以提高样本利用效率