待验证50% 置信事实精确时间
Big Bench 最初是由 Google 发起的大规模语言模型评测框架,涵盖数百项任务以衡量模型的推理、语言理解等综合能力
1
来源数
50%
置信度
长期有效
时效性
2026/9/9
首次发现
来源
涉及实体
相关事实
待验证大语言模型随参数规模增长突然涌现出思维链推理能力,由Google的涌现能力论文系统记录75% 相似待验证BIG-Bench 是由 Google 主导、超过 450 位研究者协作构建的基准测试集,包含 200 多个任务73% 相似待验证Google的Gemini采用SentencePiece框架配合Unigram语言模型算法进行分词68% 相似待验证工具增强语言模型(Tool-Augmented Language Model,TALM)最早的系统性论述可追溯至 2022 年 Google 发表的同名论文64% 相似待验证Google Dialogflow使用了BERT等预训练模型进行意图分类和槽位填充63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/883442API
curl https://kongchang.com/api/v1/knowledge/claims/883442MCP
get_claim(id=883442)