Unverified90% confidenceFactTime unknown
AlphaStar在2019年在《星际争霸II》欧服达到大师级水平(前0.15%),通过模仿学习与多智能体强化学习的结合实现
1
Sources
90%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
DeepMind联手EVE Online:为何选择这款20年老游戏做AI研究?
twitterdemishassabis
Related Entities
Related Claims
UnverifiedAlphaStar采用多智能体自我博弈和联盟训练机制,其训练量相当于人类玩家200年的游戏经验75% similarUnverified2019年的AlphaStar面临不完全信息、实时决策和高达10^26的动作空间,其联盟训练机制使训练量相当于人类玩家200年的游戏经验74% similarUnverifiedAlphaGo击败人类围棋冠军是强化学习的标志性应用73% similarUnverified代码任务的强化学习自我博弈(Self-Play)机制借鉴了AlphaGo的训练范式60% similarUnverifiedAlphaZero复现使用JAX和Flax搭建强化学习训练流水线,通过多TPU Pod进行从零开始的自我对弈训练57% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/26555API
curl https://kongchang.com/api/v1/knowledge/claims/26555MCP
get_claim(id=26555)