OpenAI 部署 Jalapeño ASIC 时选用 AMD Turin 而非 Nvidia Vera 作为主机
OpenAI 的新款 Jalapeño ASIC 目前在公司内部与 AMD EPYC Turin 主机搭配部署,每台主机配备 1.5TB 内存。SemiAnalysis 在这款芯片公布后详细介绍了其机架级部署方案,我们也借此采访了 OpenAI 硬件副总裁兼负责人 Richard Ho。他告诉我们,选择 Turin 是一个“务实”的决定,并称 Nvidia 新推出的 Vera CPU“在成熟度上还稍差一些”。
“我们当时的思路是降低风险、加快设计速度。Vera 作为一款独立产品,成熟度还稍有欠缺。Turin 则非常可靠,能满足我们的需求,而且我们的合作伙伴也有相关经验,”Ho 告诉 Tom's Hardware Premium。“在 Jalapeño 项目上,我们力求每个决定都务实:在性能和成本目标上可以激进,但不想承担不必要的风险。这个选择很符合我们做设计决策的一贯原则。”
市面上基于 Arm 的 CPU 很多,其中不少已在各大超大规模云厂商内部部署,比如 Google Cloud 的 Axiom 和 AWS 的 Graviton。但据称 Vera 和 Arm 自家的 AGI 属于“agentic CPU”,相比 AMD 和 Intel 的 x86 产品,能更好地加速 agentic loop 中涉及的复杂推理。鉴于 OpenAI 与 Nvidia 合作紧密,我们问 Ho 为何 Turin 才是正确选择,他便给出了上面那段回答。
Arm 一直宣传 AArch64 ISA 相比 x86 的优势,甚至声称其自家 AGI CPU 的性能是现代 x86 平台的两倍以上。不过这一说法基于内部估算,并非真实的基准测试结果。Arm 自然对 AGI 的市场前景非常乐观,但即便已有高达 20 亿美元的订单承诺,分析师认为其市场渗透率在两年后仍只能达到低个位数百分比。
OpenAI 选择 Turin 的有趣之处在于,据 Nvidia 所说,它既是 Arm 部署 AGI 的合作伙伴之一,也在"探索 Vera CPU"的客户名单之列。OpenAI、其他前沿实验室以及超大规模云厂商的硬件阵容向来多元。最终专门选择 Turin 与 Jalapeño 搭配,是为了降低风险,Ho 指出这个平台的成熟度是关键因素。