Unverified50% confidenceFactExact time
CLIP的训练数据来自互联网公开爬取的数据集WIT(WebImageText),其规模约为ImageNet(约1400万张标注图像)的近30倍
1
Sources
50%
Confidence
Long-term
Relevance
8/6/2026
First Seen
Sources
Related Claims
UnverifiedCommon Crawl项目存储了超过2500亿网页的完整HTML快照,压缩后数据量达PB级别,是许多AI模型的主要训练数据来源之一78% similarUnverified现代图像生成模型的训练数据通常来自数十亿张互联网图片及其配套的文本描述74% similarUnverifiedCLIP于2021年发布,通过从互联网收集的4亿个图像-文本配对数据进行训练73% similarUnverifiedImageNet数据集花费数年、动用数万名众包标注员才完成140万张图像的分类标注65% similarUnverifiedWhisper 的训练数据包含 68 万小时,大量来自互联网上字幕质量参差不齐的视频65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/693254API
curl https://kongchang.com/api/v1/knowledge/claims/693254MCP
get_claim(id=693254)