待验证50% 置信事实精确时间
研究从Dolly-15k、LMSYS-Chat-1M、WildChat-1M、MMLU、GSM8K和HellaSwag六个数据源采样了1242条纯英文Prompt
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
待验证可以利用ChatGPT批量生成Wildcards词汇列表,利用LLM的世界知识和指令遵循能力进行知识枚举60% 相似待验证长文档问答赛道竞争者包括ChatGPT的文件上传和Google NotebookLM等通用工具60% 相似待验证databricks-dolly-15k是Databricks于2023年开源的指令数据集,包含约15000条员工人工撰写的问答对59% 相似待验证Gap Map 开源数据包含1,184个 YAML 文件(结构化的产品条目)、采集数据的 notebooks、数据 schema 和辅助脚本58% 相似待验证本地部署的7B至14B参数模型(如Llama 3、Qwen2.5、GLM-4)已具备足够文本理解能力完成隐私文档分析任务58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/921789API
curl https://kongchang.com/api/v1/knowledge/claims/921789MCP
get_claim(id=921789)