Unverified50% confidenceFactExact time
Q-learning由Watkins于1989年提出,Watkins和Dayan于1992年证明其在有限状态空间且每个状态-动作对被无限次访问的条件下收敛到最优Q函数
1
Sources
50%
Confidence
Long-term
Relevance
8/21/2026
First Seen
Sources
Related Claims
Unverifiedmeshoptimizer 的网格简化算法基于二次误差度量(QEM)的变体实现,QEM 由 Garland 和 Heckbert 于1997年在 SIGGRAPH 上提出60% similarUnverified约束传播的思想最早可追溯至1970年代阿兰·马克沃斯对弧一致性算法的研究60% similarUnverified支持向量机(SVM)由 Vapnik 等人在 1990 年代提出,通过核函数将低维线性不可分问题映射到高维空间求解59% similarUnverified傅里叶神经算子(FNO)由Zongyi Li等人于2020年提出,学习的是无穷维函数空间之间的映射,能以比传统数值方法快数个数量级的速度求解偏微分方程59% similarUnverified在纽结理论中,AI发现了双曲体积与代数不变量之间此前未知的函数关系58% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/782690API
curl https://kongchang.com/api/v1/knowledge/claims/782690MCP
get_claim(id=782690)