待验证50% 置信事实精确时间
早在2022年,DeepMind的RLAM和Meta的ToolFormer论文就已论证了语言模型自主调用外部工具的可行性
1
来源数
50%
置信度
长期有效
时效性
2026/7/16
首次发现
来源
相关事实
待验证2022年DeepMind发布了TALM,Meta发布了Toolformer,探索让模型自主决定何时调用外部API,但依赖微调76% 相似已验证DeepMind的AlphaProof于2024年将大语言模型与Lean 4结合,通过强化学习在形式化环境中自我博弈生成并验证证明步骤73% 相似待验证2022年以后DeepMind的AlphaProof和各类大语言模型开始将神经网络与符号推理结合72% 相似待验证2017年OpenAI与DeepMind分别独立发表论文探索从人类偏好中学习的强化学习方法,2022年InstructGPT论文发表后RLHF成为LLM对齐的主流范式71% 相似待验证DeepMind推出Auto-RT项目,将大语言模型与机器人控制模型RT-2结合,用LLM作为任务规划层将自然语言指令分解为底层动作序列70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/533808API
curl https://kongchang.com/api/v1/knowledge/claims/533808MCP
get_claim(id=533808)