待验证50% 置信事实精确时间
Dyna-Q由强化学习先驱Richard Sutton于1991年提出,是一种将模型学习与无模型学习相结合的方法
1
来源数
50%
置信度
长期有效
时效性
2026/8/29
首次发现
来源
涉及实体
相关事实
已验证情境学习理论(Situated Learning Theory)由认知科学家Jean Lave和Etienne Wenger于1991年提出64% 相似待验证Richard Sutton在1988年提出了时序差分学习(TD Learning)方法63% 相似已验证Q-learning是强化学习中的值函数方法,由Watkins于1989年提出,核心是维护Q表并通过贝尔曼方程迭代更新61% 相似待验证Richard Sutton与Andrew Barto合著了《Reinforcement Learning: An Introduction》,系统性地奠定了强化学习领域的理论框架60% 相似待验证项目制学习的理论根基来自约翰·杜威的从做中学教育哲学以及让·皮亚杰的建构主义认知理论58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/822093API
curl https://kongchang.com/api/v1/knowledge/claims/822093MCP
get_claim(id=822093)