待验证85% 置信事实时间未知
NVIDIA端点目前将DeepSeek V4的输出Token上限设为16384
1
来源数
85%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
NVIDIA免费调用DeepSeek V4 Pro教程:API密钥获取与编程工具接入
bilibiliAI-seeker
涉及实体
相关事实
待验证DeepSeek V4 的最大输出可达 384K Token,GPT 5.5 为 128K Token72% 相似待验证NVIDIA在Hugging Face发布Qwen3 235B的NVFP4量化模型,将模型从BF16的约470GB显存压缩至约156GB,可运行在8张H100单节点集群上72% 相似待验证NVIDIA A100的理论FP16峰值算力约为312 TFLOPS,但朴素LLM推理场景下GPU利用率常不足30%70% 相似已验证DeepSeek V4 Flash拥有284B总参数,每次激活13B,显存需求约150G70% 相似待验证DeepSeek-V4 Pro版参数达1.6T,每次推理激活49B;Flash版参数284B,激活13B69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/22249API
curl https://kongchang.com/api/v1/knowledge/claims/22249MCP
get_claim(id=22249)