tradingkey.logo
搜索

OpenAI 声称其 Jalapeño 芯片在推理能力方面优于英伟达的 GB300。

Cryptopolitan2026年8月25日 17:59
facebooktwitterlinkedin

OpenAI 发布了其与博通公司合作开发的自主研发推理芯片 Jalapeño 的首个基准测试结果。.

该公司声称,与对比测试的英伟达 GB200 和 GB300 机架系统相比,该芯片每瓦特的 AI 工作量更大,返回结果的速度也更快。.

OpenAI 的新芯片性能如何?

OpenAI 公布了其自主研发的新型 AI 芯片 Jalapeño 的基准测试结果 。该芯片通过了 SemiAnalysis 的公开基准测试 InferenceX 进行测试,该测试用于衡量处理 AI 请求的完整工作量。测试平台包括 OpenAI 自家的 GPT-OSS 120B、DeepSeek 的 R1 670B 以及 Moonshot AI 的 Kimi K2.5 1T。

OpenAI 表示,其新芯片每单位电量所完成的工作量是其他受测系统的 1.5 到 1.9 倍,响应请求的速度也快了 1.7 到 3.6 倍。.

对于需要反复沟通的实践性任务,这种差距扩大到 2.1 到 4.1 倍。.

OpenAI 的硬件副dentRichard Ho 告诉记者,该芯片一次可以处理更多的工作,而且响应速度更快,这是大多数芯片无法同时做到的。.

此次对比测试的基准是英伟达的GB200和GB300超级芯片,这是InferenceX当时取得的最佳成绩。在测试的最大模型Kimi K2.5上,OpenAI表示,Jalapeño的每瓦峰值性能约为Kimi K2.5的1.5倍,延迟则降低了3.4倍。.

目前没有租赁市场,没有实例类型,也没有出售 Jalapeno 的计划。当被问及 OpenAI 是否会向其他人提供该芯片时,Ho 表示,该公司“正努力获得足够的”计算能力来满足自身需求。.

OpenAI 拥有预算和场地,但目前受限于数据中心电力,而不是预算或场地,因此每兆瓦的代币数量才是衡量其性能的关键指标。.

ChatGPT 和 API 的推理过程持续进行,因此,在 OpenAI 的规模下,降低每个令牌的功耗会迅速产生累积效应。该芯片的额定功耗为 700 瓦,但在测试的工作负载下,功耗保持在 550 瓦或以下。.

这款芯片符合 OpenAI 与 Broadcom 于 2025 年 10 月达成的协议,该协议旨在到 2029 年部署 10 吉瓦的 OpenAI 设计的加速器。Cryptopolitan Cryptopolitan 报道过该合作关系的最初构想。

OpenAI 是否会完全改用自家芯片?

在Hot Chips大会上,Ho表示OpenAI将以128个芯片为一组部署该芯片,一个完整的集群将运行2048个ASIC芯片。128个芯片的部署可提供1.7 exaflops的4位计算能力和27.5 TB的HBM4内存,每个芯片的内存带宽为每秒15.4 TB。.

OpenAI表示,他们利用自主研发的模型加速了Jalapeno的开发,仅用了九个月就完成了从设计到流片的整个过程。Ho补充说,第二代Jalapeno正在“深入开发中”,第三代也正在开发中。.

然而,即便OpenAI宣称其性能卓越,他们也并未打算更换现有的GPU集群。Ho表示,Jalapeño只是OpenAI计算战略的一部分,该战略仍然依赖于Nvidia和Cerebras这两家“非常优秀的合作伙伴”。据报道,这款芯片将于2026年底开始小批量部署,并在2027年逐步扩大规模。.

值得注意的是,所有数据均来自 OpenAI; SemiAnalysis 亲自验证了 InferenceX 的运行情况,但没有运行完整的测试套件,也没有查看 AgentX 的结果。

最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有