待验证50% 置信事实精确时间
Common Crawl是非营利组织运营的大规模网络爬取项目,每月抓取数十亿网页,数据集被用于训练包括GPT系列在内的大型语言模型
1
来源数
50%
置信度
长期有效
时效性
2026/8/12
首次发现
来源
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/736887API
curl https://kongchang.com/api/v1/knowledge/claims/736887MCP
get_claim(id=736887)