輝達Groq 3 LPX進入全面量產,機架今年上線,AI推論效能大增
輝達宣佈基於 Groq 技術的 NVIDIA Groq 3 LPX 進入全面量產並將於今年上線,作為 Vera Rubin 平台核心部分進軍 AI 推理市場。該機架系統結合 Vera Rubin 後,顯著提升 AI 資料中心推理吞吐量與工作處理量。雙方合作從技術授權邁入商業化部署,標誌著輝達算力佈局從模型訓練延伸至實際運行,低延遲推理技術將成為其擴大市場覆蓋的重要動能。

TradingKey - 輝達 (NVDA) 週一宣布,基於 Groq 技術打造的 NVIDIA Groq 3 LPX 已經進入全面量產階段,相關機架系統將在今年上線。Groq 3 LPX 將作為 Vera Rubin 平台的重要組成部分,主要面向快速成長的 AI 推理市場,進一步完善輝達從 AI 模型訓練到實際運行的算力佈局。
根據輝達公布的資訊,每套 Groq 3 LPX 機架包含 256 顆 Groq 3 LPU。輝達表示,在部分大型 AI 模型推理任務中,Groq 3 LPX 與 Vera Rubin 結合後,每兆瓦推理吞吐量最高可提高約 35 倍,並提升 AI 資料中心在相同電力條件下能夠處理的工作量。
2025 年年底,輝達與 Groq 簽署非獨家技術授權協議,並吸納 Groq 創辦人 Jonathan Ross 及部分核心團隊成員。Groq 公司本身仍保持獨立營運,並繼續發展 GroqCloud 業務。今年 8 月,Groq 又正式成為輝達雲端夥伴。
與此同時,Groq 自身也正在加快採用輝達新平台。公司 8 月 24 日宣布,將成為首批將 NVIDIA Groq 3 LPX 和 Vera Rubin NVL72 引入市場的雲端服務業者之一。結合輝達此次確認 Groq 3 LPX 進入全面量產,意味著雙方合作已經從技術授權逐漸進入產品落地與商業部署階段。
對輝達而言,Groq 3 LPX 今年上線的意義在於進一步強化其在 AI 推理市場的競爭力。過去 AI 算力需求主要由大模型訓練推動,但隨著 ChatGPT、Claude 以及各類 AI Agent 用戶規模擴大,模型每天實際運行產生的推理需求正在快速成長。輝達因此正在將 Vera Rubin 從單純的 GPU 平台擴展為包含 GPU、CPU、Groq LPU、網路和儲存在內的完整 AI 基礎設施。
隨著 Groq 3 LPX 進入全面量產並計劃今年上線,輝達與 Groq 的合作正式邁入商業化階段。若 AI 產業下一階段的算力成長重心進一步從「訓練模型」轉向「運行模型」,Groq 的低延遲推理技術將成為輝達擴大 AI 晶片市場覆蓋範圍的重要補充。
本內容經由 AI 翻譯並經人工審閱,僅供參考與一般資訊用途,不構成投資建議。












