Unverified50% confidenceFactExact time
智能体-环境交互模型由Richard Sutton和Andrew Barto在1990年代的经典教材中系统化
1
Sources
50%
Confidence
Long-term
Relevance
7/24/2026
First Seen
Sources
GPT-5.6发布:多智能体协同如何终结对话框时代
bilibili吃人的代码7/11/2026
Related Claims
UnverifiedRichard Sutton和Andrew Barto在1998年出版的《Reinforcement Learning: An Introduction》系统形式化了RL理论框架70% similarUnverified强化学习的理论根源可追溯至20世纪80年代Sutton与Barto的开创性工作64% similarUnverified复杂适应系统(CAS)理论框架由圣塔菲研究所的John Holland等学者在20世纪90年代系统化提出62% similarVerifiedSutton与Barto于1988年出版了《Reinforcement Learning: An Introduction》59% similarUnverifiedRichard Sutton在1990年提出的Dyna架构首次将基于模型的规划与无模型学习统一58% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/609668API
curl https://kongchang.com/api/v1/knowledge/claims/609668MCP
get_claim(id=609668)