待验证50% 置信基准精确时间
ExoLabs已能在4台Spark上以每秒30个token的速度运行5500亿参数的Nemotron 3.0
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/19
首次发现
有效期至:2026/10/17
来源
相关事实
待验证英伟达发布Nemotron 3 Ultra,拥有5500亿参数,采用MoE架构,专面向长时间运行的AI智能体任务68% 相似待验证Nemotron 系列模型的名称中「Nano」表示参数量在数十亿级别(通常为 4B-8B 参数),适合在单张消费级 GPU 上运行63% 相似已验证M4芯片的Neural Engine每秒可执行38万亿次运算(38 TOPS)61% 相似待验证NVIDIA has developed a model called Nemotron Ultra with 550 billion parameters61% 相似待验证去噪塔仅用2.1万亿token训练,而原始Nemotron Nano使用了25万亿token,因此该模型是解码方式的转换而非更聪明的模型61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/561418API
curl https://kongchang.com/api/v1/knowledge/claims/561418MCP
get_claim(id=561418)