← 文章 / 行业与公司动态
Tom's Hardware 1小时前 · 2026-09-21 23:55:59 · 1 阅读

华为因国内产能吃紧暂缓全球AI芯片发布,Atlas集群借光网络技术抗衡Nvidia

华为本周宣布,受产能限制影响,公司正努力满足国内需求,因此其下一代颇具实力的 Ascend 900 系列 AI 加速器将仅在中国提供,不会在国际市场发售。尽管即将推出的 Ascend 960 系列神经网络处理器(NPU)有望匹敌 AMD 和 Nvidia 现有的部分 AI GPU,但这些设备在海外的需求本就不稳定。

TH Premium 深入解读:AI 短缺

Nvidia

(图片来源:Nvidia)

华为轮值董事长徐直军在华为全联接大会期间表示:“由于我们的产能甚至无法满足中国国内的需求,我们目前没有以完全成熟的方式进入国际市场的计划,”路透社报道称。他还补充说,华为仅向“需求特别旺盛的一些国家”供应有限数量的产品,但未进一步说明细节。

本周,华为公布了最新的 AI 加速器路线图,披露了下一代 Ascend 960、970 和 980 NPU 在训练和推理性能上的显著提升,超越现有的 Ascend 910C 和 Ascend 950 系列。Ascend 960DT 和 960PR 预计将在 2027 年将 FP8 训练性能提升至 2 PFLOPS,FP4 推理性能分别提升至 4 PFLOPS 和 8 PFLOPS。与此同时,其后续型号 Ascend 970 和 Ascend 980 预计在未来几年内将 FP4 性能分别提升至 14 PFLOPS 和 28 PFLOPS。

NPU

FP8 性能

FP4 性能

内存容量

内存带宽

互连带宽

目标发布时间

Nvidia H200

4 PFLOPS

-

141 GB HBM3E

4.8 TB/s

900 GB/s

2023 Q4

Nvidia B300

10 PFLOPS

15/20 S/D PFLOPS

279 GB HBM3E

8 TB/s

1.8 TB/s

2025 Q4

Ascend 950PR

1 PFLOPS

2 PFLOPS

128 GB HiBL 1.0

1.6 TB/s

2 TB/s

2026 Q1

Ascend 950DT

1 PFLOPS

2 PFLOPS

144 GB HiZQ 2.0

4.0 TB/s

2 TB/s

2026 Q4

Nvidia R200

17.5 PFLOPS

35/50 T/I PFLOPS

288 GB HBM4

19.2 TB/s

3 TB/s

2026 Q4

Ascend 960DT

2 PFLOPS

4 PFLOPS

288 GB

9.6 TB/s

2.2 TB/s

2027 Q1

Ascend 960PR

2 PFLOPS

8 PFLOPS

192 GB

2.4 TB/s

2.2 TB/s

2027 Q3

Ascend 970

3.6 PFLOPS

14 PFLOPS

288 GB

14.4 TB/s

4.4 TB/s

2028

Ascend 980

7.2 PFLOPS*

28 PFLOPS*

384 GB

38.4 TB/s*

8 TB/s

2029

*初步数据
S/D - 稀疏与稠密算力
T/I - 训练与推理

虽然即将推出的 Ascend NPU 性能将明显超越前代产品,尤其是在推理方面,但至少从原始算力来看,它们仍将远远落后于 Nvidia 的上一代和当前一代加速器。华为 2027 年的 Ascend 960DT 预计可提供 2 FP8 TFLOPS 的训练算力,而 Nvidia 早在 2023 年发布的 H200 就已达到 4 FP8 TFLOPS。Ascend 960PR 预计可提供 8 FP4 PFLOPS 的训练算力,与提供 15–20 NVFP4 PFLOPS 的 Nvidia B300 相差甚远。即便是计划 2029 年推出的 Ascend 980,预计也只达到 7.2 FP8 PFLOPS 和 28 FP4 PFLOPS,远低于 Nvidia 今年就将交付 17.5 FP8 PFLOPS 和 35/50 FP4 PFLOPS 的 R200。

与顶尖 AI 硬件之间存在如此巨大的性能差距,意味着华为只能依靠大规模的系统级扩展、而非单芯片性能来与 Nvidia 竞争。但系统级扩展必然带来巨大的功耗,这会让华为下一代 Atlas SuperPoD 和 SuperCluster 在能够买到 AMD 或 Nvidia 硬件的市场上竞争力大打折扣。

华为目前正处于一个耐人寻味的矛盾局面:一方面,近封装光学(NPO)等集成技术确实释放了“较旧”工艺节点的产能,可用于 AI 平台的其他组件;但另一方面,中芯国际在 7nm 和 6nm 级节点上产能爬坡乏力,限制了华为 AI 硬件的供应能力——这也是它连需求都难以满足的原因。

原始来源: Tom's Hardware

评论 (0)