待验证50% 置信事实精确时间
Q-learning由Watkins于1989年提出,Watkins和Dayan于1992年证明其在有限状态空间且每个状态-动作对被无限次访问的条件下收敛到最优Q函数
1
来源数
50%
置信度
长期有效
时效性
2026/8/21
首次发现
来源
相关事实
待验证meshoptimizer 的网格简化算法基于二次误差度量(QEM)的变体实现,QEM 由 Garland 和 Heckbert 于1997年在 SIGGRAPH 上提出60% 相似待验证约束传播的思想最早可追溯至1970年代阿兰·马克沃斯对弧一致性算法的研究60% 相似待验证支持向量机(SVM)由 Vapnik 等人在 1990 年代提出,通过核函数将低维线性不可分问题映射到高维空间求解59% 相似待验证傅里叶神经算子(FNO)由Zongyi Li等人于2020年提出,学习的是无穷维函数空间之间的映射,能以比传统数值方法快数个数量级的速度求解偏微分方程59% 相似待验证在纽结理论中,AI发现了双曲体积与代数不变量之间此前未知的函数关系58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/782690API
curl https://kongchang.com/api/v1/knowledge/claims/782690MCP
get_claim(id=782690)