[KongchangAI]
ProductB70 / Intel Arc Pro B70

Arc Pro B70

Intel推出的工作站级AI加速显卡,基于XE2 Battlemage架构,采用台积电N5工艺,配备32GB显存,面向专业AI推理应用

Timeline (last 90 days)

Oct 5

AMD Radeon AI Pro R9700 和 Intel Arc Pro B70 都配备 32GB 显存和 256-bit 位宽,内存带宽相差不到 5%

Unverified50%
Oct 5

R9700 首发价 1299 美元,B70 首发价 949 美元

Unverified50%
Oct 5

截至9月价格追踪,R9700 落在 1700-1810 美元区间,B70 落在 1300-1460 美元之间

Unverified50%
Oct 5

按显存容量折算,B70 约为 41 美元/GB,R9700 约为 55 美元/GB

Unverified50%
Oct 5

B70 基于 XE2 Battlemage 架构(台积电 N5 工艺),拥有 32 个 XE 核心、256 个 XMX 引擎,带宽 608GB/s,FP32 约 23 TFLOPS

Unverified50%
Oct 5

Puget Systems 测算显示 R9700 的 FP32 约为 B70 的两倍,矩阵吞吐约为其 5 倍

Unverified50%
Oct 5

在 Qwen3 27B 的 llama.cpp 环境下,R9700 跑出 27.1 tokens/s(达带宽上限约65%),B70 跑出 21.4 tokens/s(约50%出头)

Unverified50%
Oct 5

启用多token预测(MTP)草拟深度为2时,R9700 从 27.1 升到 46.2 tokens/s(+70%),B70 从 21.4 升到 28.4 tokens/s(+33%)

Unverified50%
Oct 5

MESA 26.1 驱动使 B70 在 Qwen3 30B-A3B 类 MoE 模型上的 Vulkan 路径从 38 翻倍到 76 tokens/s,接近 R9700 的约 77 tokens/s

Unverified50%
Oct 5

在密集型中等规模模型(如27B)上AMD R9700 明显领先,MoE 模型上两者基本持平,小型负载上 B70 略占上风

Unverified50%

2 more timeline events

All Facts (12)

Unverified

AMD Radeon AI Pro R9700 和 Intel Arc Pro B70 都配备 32GB 显存和 256-bit 位宽,内存带宽相差不到 5%

50%
Unverified

R9700 首发价 1299 美元,B70 首发价 949 美元

50%
Unverified

截至9月价格追踪,R9700 落在 1700-1810 美元区间,B70 落在 1300-1460 美元之间

50%
Unverified

按显存容量折算,B70 约为 41 美元/GB,R9700 约为 55 美元/GB

50%
Unverified

B70 基于 XE2 Battlemage 架构(台积电 N5 工艺),拥有 32 个 XE 核心、256 个 XMX 引擎,带宽 608GB/s,FP32 约 23 TFLOPS

50%
Unverified

Puget Systems 测算显示 R9700 的 FP32 约为 B70 的两倍,矩阵吞吐约为其 5 倍

50%
Unverified

在 Qwen3 27B 的 llama.cpp 环境下,R9700 跑出 27.1 tokens/s(达带宽上限约65%),B70 跑出 21.4 tokens/s(约50%出头)

50%
Unverified

启用多token预测(MTP)草拟深度为2时,R9700 从 27.1 升到 46.2 tokens/s(+70%),B70 从 21.4 升到 28.4 tokens/s(+33%)

50%
Unverified

MESA 26.1 驱动使 B70 在 Qwen3 30B-A3B 类 MoE 模型上的 Vulkan 路径从 38 翻倍到 76 tokens/s,接近 R9700 的约 77 tokens/s

50%
Unverified

在密集型中等规模模型(如27B)上AMD R9700 明显领先,MoE 模型上两者基本持平,小型负载上 B70 略占上风

50%
Unverified

一位B70用户使用 vLLM + GPT-Q INT4 量化、MTP 深度4,在27B模型上跑出 84.6 tokens/s,但只支持单流且用了不同量化无法直接对比

50%
Unverified

B70 的标准 Ollama 跑在 CPU 而非显卡上,vLLM 无原生 Windows 路径需走 WSL2 + Docker

50%

Source Articles