OpenAI 聲稱其 Jalapeño 芯片在推理能力方面優於英偉達的 GB300。
OpenAI 發佈了其與博通公司合作開發的自主研發推理芯片 Jalapeño 的首個基準測試結果。.
該公司聲稱,與對比測試的英偉達 GB200 和 GB300 機架系統相比,該芯片每瓦特的 AI 工作量更大,返回結果的速度也更快。.
OpenAI 的新芯片性能如何?
OpenAI 公佈了其自主研發的新型 AI 芯片 Jalapeño 的基準測試結果 。該芯片通過了 SemiAnalysis 的公開基準測試 InferenceX 進行測試,該測試用於衡量處理 AI 請求的完整工作量。測試平臺包括 OpenAI 自家的 GPT-OSS 120B、DeepSeek 的 R1 670B 以及 Moonshot AI 的 Kimi K2.5 1T。
OpenAI 表示,其新芯片每單位電量所完成的工作量是其他受測系統的 1.5 到 1.9 倍,響應請求的速度也快了 1.7 到 3.6 倍。.
對於需要反覆溝通的實踐性任務,這種差距擴大到 2.1 到 4.1 倍。.
OpenAI 的硬件副dentRichard Ho 告訴記者,該芯片一次可以處理更多的工作,而且響應速度更快,這是大多數芯片無法同時做到的。.
此次對比測試的基準是英偉達的GB200和GB300超級芯片,這是InferenceX當時取得的最佳成績。在測試的最大模型Kimi K2.5上,OpenAI表示,Jalapeño的每瓦峯值性能約爲Kimi K2.5的1.5倍,延遲則降低了3.4倍。.
目前沒有租賃市場,沒有實例類型,也沒有出售 Jalapeno 的計劃。當被問及 OpenAI 是否會向其他人提供該芯片時,Ho 表示,該公司“正努力獲得足夠的”計算能力來滿足自身需求。.
OpenAI 擁有預算和場地,但目前受限於數據中心電力,而不是預算或場地,因此每兆瓦的代幣數量纔是衡量其性能的關鍵指標。.
ChatGPT 和 API 的推理過程持續進行,因此,在 OpenAI 的規模下,降低每個令牌的功耗會迅速產生累積效應。該芯片的額定功耗爲 700 瓦,但在測試的工作負載下,功耗保持在 550 瓦或以下。.
這款芯片符合 OpenAI 與 Broadcom 於 2025 年 10 月達成的協議,該協議旨在到 2029 年部署 10 吉瓦的 OpenAI 設計的加速器。Cryptopolitan Cryptopolitan 報道過該合作關係的最初構想。
OpenAI 是否會完全改用自家芯片?
在Hot Chips大會上,Ho表示OpenAI將以128個芯片爲一組部署該芯片,一個完整的集羣將運行2048個ASIC芯片。128個芯片的部署可提供1.7 exaflops的4位計算能力和27.5 TB的HBM4內存,每個芯片的內存帶寬爲每秒15.4 TB。.
OpenAI表示,他們利用自主研發的模型加速了Jalapeno的開發,僅用了九個月就完成了從設計到流片的整個過程。Ho補充說,第二代Jalapeno正在“深入開發中”,第三代也正在開發中。.
然而,即便OpenAI宣稱其性能卓越,他們也並未打算更換現有的GPU集羣。Ho表示,Jalapeño只是OpenAI計算戰略的一部分,該戰略仍然依賴於Nvidia和Cerebras這兩家“非常優秀的合作伙伴”。據報道,這款芯片將於2026年底開始小批量部署,並在2027年逐步擴大規模。.
值得注意的是,所有數據均來自 OpenAI; SemiAnalysis 親自驗證了 InferenceX 的運行情況,但沒有運行完整的測試套件,也沒有查看 AgentX 的結果。
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?








