待验证50% 置信基准精确时间
FlashInfer MNNVL纯AllReduce使DeepSeek-V4-Flash TP4解码在Blackwell架构小批量下获得最高+6.9%性能提升
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/5
首次发现
有效期至:2026/12/4
来源
涉及实体
相关事实
待验证FlashInfer纯allreduce特性已为DeepSeek-V3/V3.2/V4自动启用,其他模型可通过--enable-flashinfer-pure-allreduce手动开启76% 相似待验证DeepSeek V4 Flash是Pro的蒸馏或精简版本,在保留核心编程能力的同时大幅降低了推理开销72% 相似已验证DeepSeek将实验性多模态模型V4-Flash-Vision-EXP上线API平台,其文本能力与V4 Flash持平,多模态智能体基准测试性能接近Opus 4.8水平70% 相似待验证DeepSeek-V4-Flash-Vision-Exp采用MIT许可开放权重,并提供Tensor与Tokenizer参考实现及最小化PyTorch推理代码69% 相似待验证DeepSeek在7月的更新日志中将一个内部Harness(称为「极简模式」)归功为V4 Flash编程基准评分的幕后功臣68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/860551API
curl https://kongchang.com/api/v1/knowledge/claims/860551MCP
get_claim(id=860551)