OpenAI 表示,Jalapeño 在两项推理基准测试中以 700 瓦的功耗击败了 Nvidia GB300,计划于 2026 年晚些时候部署,以降低成本并加快响应速度。

关键点:

OpenAI 表示,Jalapeño 在测试中每单位功耗的吞吐量和响应速度均领先于 Nvidia 的 GB300。这款 700 瓦的推理芯片旨在降低数据中心成本,同时更快地提供 AI 模型服务。Jalapeño 并非为模型训练而设计,也未与 Nvidia 更新的 Vera Rubin 系列进行测试对比。

OpenAI 表示,Jalapeño 在测试中每单位功耗的吞吐量和响应速度均领先于 Nvidia 的 GB300。

这款 700 瓦的推理芯片旨在降低数据中心成本,同时更快地提供 AI 模型服务。

Jalapeño 并非为模型训练而设计,也未与 Nvidia 更新的 Vera Rubin 系列进行测试对比。

OpenAI 基准测试

OpenAI 表示,其定制的 Jalapeño 处理器在衡量每单位功耗的 AI 工作量和返回响应速度的测试中表现优于 Nvidia 的 GB300。

OpenAI 芯片负责人 Richard Ho 表示,Jalapeño 结合了高吞吐量和低延迟,可能让客户选择优先考虑更低成本或更快答案的模型。

据 Ho 介绍,Jalapeño 是与 Broadcom 合作开发的,在 700 瓦功耗下运行并取得了上述测试结果。电力是数据中心的主要成本之一。