Verified65% confidenceFactExact time
DeepMind的AlphaGo通过自我对弈数百万局来习得围棋策略
3
Sources
65%
Confidence
Long-term
Relevance
7/21/2026
First Seen
Sources
Related Claims
VerifiedDeepMind的AlphaStar使用人类对局数据进行行为克隆初始化,再通过自我对弈强化学习达到职业选手水平81% similarUnverified2016年DeepMind的AlphaGo通过与人类棋谱学习加自我对弈击败了围棋世界冠军79% similarUnverifiedDeepMind的AlphaGo核心算法之一是蒙特卡洛树搜索(MCTS),通过大量随机对弈模拟评估棋局78% similarUnverifiedDeepMind的AlphaGo是强化学习赋予Agent自主学习策略路径的标志性成果78% similarUnverifiedDeepMind的AlphaZero于2017年发布,仅凭自我对弈就在国际象棋、将棋和围棋上达到超越人类顶尖水平76% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/577501API
curl https://kongchang.com/api/v1/knowledge/claims/577501MCP
get_claim(id=577501)