tradingkey.logo
搜尋

OpenAI 聲稱其 Jalapeño 芯片在推理能力方面優於英偉達的 GB300。

Cryptopolitan2026年8月25日 17:59
facebooktwitterlinkedin

OpenAI 發佈了其與博通公司合作開發的自主研發推理芯片 Jalapeño 的首個基準測試結果。.

該公司聲稱,與對比測試的英偉達 GB200 和 GB300 機架系統相比,該芯片每瓦特的 AI 工作量更大,返回結果的速度也更快。.

OpenAI 的新芯片性能如何?

OpenAI 公佈了其自主研發的新型 AI 芯片 Jalapeño 的基準測試結果 。該芯片通過了 SemiAnalysis 的公開基準測試 InferenceX 進行測試,該測試用於衡量處理 AI 請求的完整工作量。測試平臺包括 OpenAI 自家的 GPT-OSS 120B、DeepSeek 的 R1 670B 以及 Moonshot AI 的 Kimi K2.5 1T。

OpenAI 表示,其新芯片每單位電量所完成的工作量是其他受測系統的 1.5 到 1.9 倍,響應請求的速度也快了 1.7 到 3.6 倍。.

對於需要反覆溝通的實踐性任務,這種差距擴大到 2.1 到 4.1 倍。.

OpenAI 的硬件副dentRichard Ho 告訴記者,該芯片一次可以處理更多的工作,而且響應速度更快,這是大多數芯片無法同時做到的。.

此次對比測試的基準是英偉達的GB200和GB300超級芯片,這是InferenceX當時取得的最佳成績。在測試的最大模型Kimi K2.5上,OpenAI表示,Jalapeño的每瓦峯值性能約爲Kimi K2.5的1.5倍,延遲則降低了3.4倍。.

目前沒有租賃市場,沒有實例類型,也沒有出售 Jalapeno 的計劃。當被問及 OpenAI 是否會向其他人提供該芯片時,Ho 表示,該公司“正努力獲得足夠的”計算能力來滿足自身需求。.

OpenAI 擁有預算和場地,但目前受限於數據中心電力,而不是預算或場地,因此每兆瓦的代幣數量纔是衡量其性能的關鍵指標。.

ChatGPT 和 API 的推理過程持續進行,因此,在 OpenAI 的規模下,降低每個令牌的功耗會迅速產生累積效應。該芯片的額定功耗爲 700 瓦,但在測試的工作負載下,功耗保持在 550 瓦或以下。.

這款芯片符合 OpenAI 與 Broadcom 於 2025 年 10 月達成的協議,該協議旨在到 2029 年部署 10 吉瓦的 OpenAI 設計的加速器。Cryptopolitan Cryptopolitan 報道過該合作關係的最初構想。

OpenAI 是否會完全改用自家芯片?

在Hot Chips大會上,Ho表示OpenAI將以128個芯片爲一組部署該芯片,一個完整的集羣將運行2048個ASIC芯片。128個芯片的部署可提供1.7 exaflops的4位計算能力和27.5 TB的HBM4內存,每個芯片的內存帶寬爲每秒15.4 TB。.

OpenAI表示,他們利用自主研發的模型加速了Jalapeno的開發,僅用了九個月就完成了從設計到流片的整個過程。Ho補充說,第二代Jalapeno正在“深入開發中”,第三代也正在開發中。.

然而,即便OpenAI宣稱其性能卓越,他們也並未打算更換現有的GPU集羣。Ho表示,Jalapeño只是OpenAI計算戰略的一部分,該戰略仍然依賴於Nvidia和Cerebras這兩家“非常優秀的合作伙伴”。據報道,這款芯片將於2026年底開始小批量部署,並在2027年逐步擴大規模。.

值得注意的是,所有數據均來自 OpenAI; SemiAnalysis 親自驗證了 InferenceX 的運行情況,但沒有運行完整的測試套件,也沒有查看 AgentX 的結果。

最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。

推薦文章

tradingkey.logo
風險提示:我們的網站和行動應用程式僅提供關於某些投資產品的一般資訊。Finsights 不提供財務建議或對任何投資產品的推薦,且提供此類資訊不應被解釋為 Finsights 提供財務建議或推薦。
投資產品存在重大投資風險,包括可能損失投資的本金,且可能並不適合所有人。投資產品的過去表現並不代表其未來表現。
Finsights 可能允許第三方廣告商或關聯公司在我們的網站或行動應用程式的任何部分放置或投放廣告,並可能根據您與廣告的互動情況獲得報酬。
© 版權所有: FINSIGHTS MEDIA PTE. LTD. 版權所有