待验证50% 置信基准精确时间
在InferenceX公共基准测试中,Jalapeño峰值吞吐下每瓦任务量达到NVIDIA对比系统的1.5至1.9倍,端到端延迟降低1.7至3.6倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/24
首次发现
有效期至:2026/12/23
来源
涉及实体
相关事实
待验证Bullet 在 SWE-bench Verified 基准测试中取得 95.8% 的成绩,位列前三,平均每个任务耗时 119 秒61% 相似待验证Muse Glimmer 30B在RTX 5090上报告可达每秒74.9个token,评测者在RTX 3090上运行全精度版本观察到约60-65 token/秒60% 相似待验证响应时间只看厂商标称的1ms/0.5ms GtG意义不大,应看RTINGS等第三方实测的过冲(overshoot)数据,标称与实测常差2-3倍59% 相似待验证在 GPQA-Diamond xhigh 测试中,基座 Qwen3.8-27B 达 88.4% 准确率消耗 6,642 中位 token,Swift 保持 88.3% 准确率但 token 降至 2,77159% 相似待验证完整预训练后NCP-ArchPreview在下游任务宏观平均分上比OLMo-3-7B高出2.45分59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/945919API
curl https://kongchang.com/api/v1/knowledge/claims/945919MCP
get_claim(id=945919)