Unverified50% confidenceEventExact time
2017年OpenAI与DeepMind分别独立发表论文探索从人类偏好中学习的强化学习方法,2022年InstructGPT论文发表后RLHF成为LLM对齐的主流范式
1
Sources
50%
Confidence
Long-term
Relevance
7/16/2026
First Seen
Sources
Related Claims
UnverifiedRLHF的理论根基可追溯至2017年DeepMind与OpenAI联合发表的论文《Deep Reinforcement Learning from Human Preferences》72% similarUnverified早在2022年,DeepMind的RLAM和Meta的ToolFormer论文就已论证了语言模型自主调用外部工具的可行性71% similarUnverifiedOpenAI、Anthropic、DeepMind等机构均已将可解释性作为研究方向70% similarUnverifiedOpenSpiel 最初由 DeepMind 于 2019 年开源,是专注于棋盘与桌面游戏的强化学习研究平台67% similarVerifiedOpenAI、Anthropic和Google DeepMind均已在各自模型中集成了类似的智能体能力框架66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/533596API
curl https://kongchang.com/api/v1/knowledge/claims/533596MCP
get_claim(id=533596)