待验证50% 置信事实精确时间
Epoch AI估算互联网上可公开获取的高质量文本数据总量约在4.6万亿到17万亿token之间
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/27
首次发现
有效期至:2026/11/25
来源
涉及实体
相关事实
待验证截至2024年,互联网档案馆数字馆藏包含超过3500万本书籍和文本、145亿个网页快照、超过1400万条音频记录和600万段视频,年运营预算约5000万美元69% 相似待验证网页抓取是AI Agent中成本最高的工具调用类型之一,普通网页原始HTML通常包含数万到数十万个字符68% 相似待验证现代网页的DOM树序列化后可能包含数千甚至上万个Token,导致AI浏览器自动化操作的Token消耗巨大68% 相似待验证整个互联网可抓取的公开网页数据(Common Crawl)约400TB67% 相似待验证据Sensity AI统计,2023年网络上检测到的deepfake内容数量同比增长超过900%67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/810362API
curl https://kongchang.com/api/v1/knowledge/claims/810362MCP
get_claim(id=810362)