[控场AI]
模型Deep Q-Network / DQN算法

DQN

DeepMind于2013年提出的深度强化学习算法,首次将深度神经网络与Q-learning结合,引入经验回放机制

时间轴 (近 90 天)

8月23日

经验回放最早在DeepMind的DQN算法中被提出,智能体将过去的交互经验存储在缓冲区中,训练时随机采样以提高样本利用效率

待验证50%

全部知识事实 (1)

来源文章