待验证50% 置信基准精确时间
在Gemma 4 12B模型的Token生成测试中,Spark达26.4 tokens/s、Halo 24.6 tokens/s、M4 Pro最快33.8 tokens/s
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/12
首次发现
有效期至:2026/10/10
来源
AMD Ryzen AI Halo实测:x86架构能否撼动英伟达DGX Spark?
bilibili量子菠萝_2026/7/7
相关事实
待验证根据Artificial Analysis数据,Fable完成单个任务约用33k token,Opus 5约用37k token73% 相似待验证Chinchilla模型拥有70B参数和1.4T tokens,在同等算力下显著优于拥有280B参数和300B tokens的Gopher模型70% 相似待验证MiniMax M3 每个 token 推理时约激活 23B 参数69% 相似待验证In the e-commerce website test, Opus 4.8 consumed 4.898 million output tokens while Fable 5 used only 588K tokens66% 相似待验证父子分块策略用小块(128~256 Token)做精准检索,命中后返回其所属大块(512~1024 Token)作为上下文66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/489929API
curl https://kongchang.com/api/v1/knowledge/claims/489929MCP
get_claim(id=489929)