[
KongchangAI
]
Feed
Entities
Podcasts
Deep Dives
Developers
About
Get CLI
中文
Concept
Experience Replay / Replay Buffer
经验回放
深度强化学习中的核心技术,由DeepMind在2013年DQN论文中引入,将Agent与环境交互产生的状态-动作-奖励-下一状态四元组存入回放缓冲区,训练时随机采样以打破时序相关性、提升样本利用效率。
Source Articles
AI基础设施还是应用功能?CogniCore引发的架构决策之辩
Jul 22