该实体尚未建立完整档案,以下是相关知识事实
新款Blade 18显卡入门配置为Nvidia GeForce RTX 5070 Ti,最高可选配RTX 5090,整个RTX 50系列基于Nvidia Blackwell架构
95%待验证RTX 5090拥有32GB显存
90%待验证RTX 5090上Qwen3.6 27B模型Q4量化不开MTP解码速度约63 token/s,开启MTP后跳到105 token/s
85%待验证RTX 5090上Qwen3.6 27B模型预填充速度从174提升到253 token/s,显存占用约18GB
85%待验证RTX 5090上Qwen3.6 35B-A3B推理速度达220 token/s,显存占用约23GB
85%待验证移动端RTX 5090采用完整的GB203核心,拥有超过10,000个CUDA核心和16GB GDDR7显存,理论算力接近上一代桌面端RTX 4090
80%待验证NVFP4依赖Tensor Core的FP4计算单元,目前仅限于5090等新卡才能运行
80%待验证GPT-OSS 20B在RTX 3090上可达约40 Token/s的生成速度,在RTX 5090上能达到200 Token/s
75%待验证使用RTX 5090(32GB显存)运行GPT-OSS-20B时,GPU显存占用约53%,系统内存占用约2.5GB,响应速度1-2秒
75%已更新使用RTX 5090(32GB显存)部署千问3.6的27B模型,上下文只能拉到约60K左右
75%待验证OmniMerge V4的Q5版本在RTX 5090上运行速度明显快于普通Q4量化版本
70%待验证在5090(32GB显存)上部署Qwen3 27B NVFP4模型,vLLM可以支持约70K的上下文长度
65%