ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
Jalapeño 芯片进入内部部署:主机不用英伟达 Vera,OpenAI 选了 AMD EPYC

Jalapeño 芯片进入内部部署:主机不用英伟达 Vera,OpenAI 选了 AMD EPYC

AI资讯 • Admin • • 8 次浏览

Jalapeño 芯片已经进入 OpenAI 的内部部署阶段,它旁边的主机配置也刚刚被确认。2026年10月2日,Tom's Hardware 在报道中援引 SemiAnalysis 对机架级部署的描述,并采访了 OpenAI 硬件副总裁 Richard Ho:Jalapeño ASIC 在部署时搭配的主机 CPU 是 AMD 的 EPYC Turin,而不是英伟达自家平台用的 Vera,每台主机配有 1.5TB 内存。

两只机架并排:一边是主机,一边是 128 颗芯片

SemiAnalysis 描述的部署形态是双机架组合。主机机架被称作 Katsu,共16个托盘,每个托盘装两颗 Turin 级别的 EPYC 处理器、1.5TB 常规内存、本地 NVMe 存储和 400G 前端网络;加速器机架被称作 Vindaloo,同样是16个托盘,每个托盘装8颗 Jalapeño,一台机架共128颗芯片,最高提供1.7 ExaFLOPs 的4-bit算力,配27.5TB HBM4 内存。两个机架之间用8根 PCIe 直连铜缆,把对应托盘一对一连起来。单颗 Jalapeño 功耗约700W,靠六组12层堆叠的 HBM4 做到15.4 TB/s 的内存带宽。

为什么主机这一票投给了 AMD

主机 CPU 在 AI 机架里负责数据预处理、任务调度和把请求喂给加速器,不是最显眼的部件,却决定整台机架的采购结构。英伟达的方案是把 GPU 和自家 Vera CPU 打包出售,买得越深,绑得越紧。OpenAI 把加速器换成自研的 Jalapeño 之后,主机再选 AMD,等于这条链路里没有英伟达的位置。这和它一贯的多供应商策略一致:训练继续用英伟达和 AMD 的 GPU,推理则逐步往自研芯片和多家供应商身上分散,避免在增长最快的推理成本上被单一供应商定价。

节奏没变:今年只是小批量,成绩单也仍是自测

需要泼一点冷水。Jalapeño 于2026年6月24日由 OpenAI 与博通共同发布,8月25日在 Hot Chips 大会上公布的首批成绩——在 SemiAnalysis 的 InferenceX 基准上,每千瓦吞吐比英伟达 GB200、GB300 高1.5到1.9倍,端到端延迟低1.7到3.6倍——来自 OpenAI 自测。Richard Ho 此前给出的时间表是2026年底以很小的批量部署、2027年才显著上量;这次主机配置得到确认,说明部署在按计划推进,但离大规模替代 GPU 还很远。对观察者来说,接下来更值得看的不是跑分,而是这批双机架系统真正上线之后,单次推理的实际成本能否稳定低于 GPU 方案。

推荐工具

更多