待验证50% 置信事实精确时间
Primitive在Hugging Face上提供了mixed NVFP4与FP8的Flash Next模型页,配套Docker镜像和模型,推理引擎为vLLM
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/28
首次发现
有效期至:2026/12/27
来源
涉及实体
相关事实
待验证量化模型托管在Hugging Face,仓库名为ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF73% 相似待验证NVIDIA在Hugging Face发布Qwen3 235B的NVFP4量化模型,NVFP4是针对Hopper和Blackwell架构的4-bit浮点格式,理论压缩比达4倍68% 相似待验证V4-Flash-Vision并非从零训练的全新架构,而是基于DeepSeek V4-Flash-0731模型外接了一个多模态插件模块63% 相似待验证LightX2V团队在Hugging Face发布了Minimax-h3-Turbo新版本FL2V Turbo 4-step v1.2 (768p),这款加速LoRA宣称仅需4步推理即可完成视频生成63% 相似已验证NVFP4是NVIDIA推出的4位浮点(FP4)量化格式,专为Blackwell架构GPU的硬件加速能力设计63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/956794API
curl https://kongchang.com/api/v1/knowledge/claims/956794MCP
get_claim(id=956794)