Verified75% confidenceFactExact time
Sutton与Barto于1988年出版了《Reinforcement Learning: An Introduction》
3
Sources
75%
Confidence
Long-term
Relevance
7/10/2026
First Seen
Sources
AI智能体强化学习:RLHF与Agentic RL核心技术解析
rss7/1/2026
Related Claims
UnverifiedRichard Sutton和Andrew Barto在1998年出版的《Reinforcement Learning: An Introduction》系统形式化了RL理论框架78% similarUnverified强化学习的理论根源可追溯至20世纪80年代Sutton与Barto的开创性工作63% similarUnverified时序差分(TD)学习由 Richard Sutton 在1988年正式提出,结合了蒙特卡洛方法和动态规划的优点61% similarUnverified智能体-环境交互模型由Richard Sutton和Andrew Barto在1990年代的经典教材中系统化59% similarUnverified混淆代理问题由Hardy于1988年首次描述51% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/465135API
curl https://kongchang.com/api/v1/knowledge/claims/465135MCP
get_claim(id=465135)