待验证50% 置信事实精确时间
BERT、GPT系列、T5等预训练大模型均以Transformer为基础架构,形成了预训练+微调的主流范式
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
已验证GPT代表'Generative Pre-trained Transformer'(生成式预训练Transformer)78% 相似待验证GPT 系列、Llama 等模型的核心能力绝大部分来自预训练而非后续微调阶段76% 相似待验证GPT-5系列采用混合专家(MoE)架构和强化学习后训练技术76% 相似已验证Transformer架构成为BERT(2018)、GPT系列、T5等现代大语言模型的核心基础,被引次数超过10万次76% 相似待验证The current mainstream approach for training LLMs uses a decoder-only Transformer architecture, the same paradigm used by the GPT series75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/566484API
curl https://kongchang.com/api/v1/knowledge/claims/566484MCP
get_claim(id=566484)