Unverified85% confidenceFactTime unknown
微软的Phi系列小模型和Google的Gemma都大量使用了合成数据进行训练
1
Sources
85%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
Shopify Agent冷启动实战:零对话数据训练生产级AI的三步法
bilibili慢学AI
Related Entities
Related Claims
Unverified微软亚洲研究院做过一个叫SynthLM的框架,专门研究怎么用预训练语料大规模生成合成数据74% similarUnverifiedMicrosoft的Phi系列和Google的Gemma系列是小语言模型的代表性工作72% similarUnverified谷歌开源了Gemma系列小模型,借鉴了Meta开放LLaMA系列的成功路径71% similarUnverifiedGemma系列模型源自Google内部的Gemini大模型技术栈,采用相同的研究成果和训练方法论70% similarUnverifiedMeta的LLaMA、Google的Gemma等主流开源模型均大量采用量化和知识蒸馏技术70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/21580API
curl https://kongchang.com/api/v1/knowledge/claims/21580MCP
get_claim(id=21580)