Unverified50% confidenceFactExact time
Decision Transformer 于 2021 年提出,将强化学习问题重新表述为序列建模问题,使用 Transformer 架构对(回报、状态、动作)序列进行自回归预测
1
Sources
50%
Confidence
Long-term
Relevance
8/8/2026
First Seen
Sources
Related Claims
Unverified学习Transformer应遵循'先建立问题意识,再引入解决方案'的四阶段路径:序列建模动机、RNN/LSTM及其局限、注意力机制、Transformer完整架构79% similarUnverifiedDecision Transformer将离线轨迹数据建模为因果序列生成问题,通过引入回报条件使模型能够在不与环境交互的情况下从静态数据集学习条件策略77% similarUnverifiedTransformer 在预训练阶段通过 Next Token Prediction 任务学习概率分布,每次输出本质是在给定上文条件下预测下一个词最可能是什么73% similarUnverified大模型幻觉现象根植于Transformer的自回归生成机制,模型在预训练阶段通过Next Token Prediction任务学习概率分布73% similarUnverified2022年论文'Are Transformers Effective for Time Series Forecasting?'发现简单线性模型在多个基准上能击败当时的Transformer变体72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/705767API
curl https://kongchang.com/api/v1/knowledge/claims/705767MCP
get_claim(id=705767)