OpenAI 声称其 Jalapeño 芯片在推理能力方面优于英伟达的 GB300。
OpenAI 发布了其与博通公司合作开发的自主研发推理芯片 Jalapeño 的首个基准测试结果。.
该公司声称,与对比测试的英伟达 GB200 和 GB300 机架系统相比,该芯片每瓦特的 AI 工作量更大,返回结果的速度也更快。.
OpenAI 的新芯片性能如何?
OpenAI 公布了其自主研发的新型 AI 芯片 Jalapeño 的基准测试结果 。该芯片通过了 SemiAnalysis 的公开基准测试 InferenceX 进行测试,该测试用于衡量处理 AI 请求的完整工作量。测试平台包括 OpenAI 自家的 GPT-OSS 120B、DeepSeek 的 R1 670B 以及 Moonshot AI 的 Kimi K2.5 1T。
OpenAI 表示,其新芯片每单位电量所完成的工作量是其他受测系统的 1.5 到 1.9 倍,响应请求的速度也快了 1.7 到 3.6 倍。.
对于需要反复沟通的实践性任务,这种差距扩大到 2.1 到 4.1 倍。.
OpenAI 的硬件副dentRichard Ho 告诉记者,该芯片一次可以处理更多的工作,而且响应速度更快,这是大多数芯片无法同时做到的。.
此次对比测试的基准是英伟达的GB200和GB300超级芯片,这是InferenceX当时取得的最佳成绩。在测试的最大模型Kimi K2.5上,OpenAI表示,Jalapeño的每瓦峰值性能约为Kimi K2.5的1.5倍,延迟则降低了3.4倍。.
目前没有租赁市场,没有实例类型,也没有出售 Jalapeno 的计划。当被问及 OpenAI 是否会向其他人提供该芯片时,Ho 表示,该公司“正努力获得足够的”计算能力来满足自身需求。.
OpenAI 拥有预算和场地,但目前受限于数据中心电力,而不是预算或场地,因此每兆瓦的代币数量才是衡量其性能的关键指标。.
ChatGPT 和 API 的推理过程持续进行,因此,在 OpenAI 的规模下,降低每个令牌的功耗会迅速产生累积效应。该芯片的额定功耗为 700 瓦,但在测试的工作负载下,功耗保持在 550 瓦或以下。.
这款芯片符合 OpenAI 与 Broadcom 于 2025 年 10 月达成的协议,该协议旨在到 2029 年部署 10 吉瓦的 OpenAI 设计的加速器。Cryptopolitan Cryptopolitan 报道过该合作关系的最初构想。
OpenAI 是否会完全改用自家芯片?
在Hot Chips大会上,Ho表示OpenAI将以128个芯片为一组部署该芯片,一个完整的集群将运行2048个ASIC芯片。128个芯片的部署可提供1.7 exaflops的4位计算能力和27.5 TB的HBM4内存,每个芯片的内存带宽为每秒15.4 TB。.
OpenAI表示,他们利用自主研发的模型加速了Jalapeno的开发,仅用了九个月就完成了从设计到流片的整个过程。Ho补充说,第二代Jalapeno正在“深入开发中”,第三代也正在开发中。.
然而,即便OpenAI宣称其性能卓越,他们也并未打算更换现有的GPU集群。Ho表示,Jalapeño只是OpenAI计算战略的一部分,该战略仍然依赖于Nvidia和Cerebras这两家“非常优秀的合作伙伴”。据报道,这款芯片将于2026年底开始小批量部署,并在2027年逐步扩大规模。.
值得注意的是,所有数据均来自 OpenAI; SemiAnalysis 亲自验证了 InferenceX 的运行情况,但没有运行完整的测试套件,也没有查看 AgentX 的结果。
最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?








