亞馬遜發佈 Trainium3 芯片,加速進軍人工智能硬件領域
亞馬遜本週推出了最新的 AI 訓練芯片 Trainium3,直接向英偉達和谷歌在硬件領域的主導地位發起挑戰。
據亞馬遜網絡服務副dent 戴夫·布朗在接受採訪時透露,該加速器已在部分AWS數據中心內運行,並將於週二向客戶開放。戴夫表示,公司不會循序漸進地推進這項服務。
“到了明年初,我們將開始快速擴張,”他說道。目標很簡單:直接從亞馬遜的機架銷售更多計算資源,而不是眼睜睜地看着開發者把錢花在其他地方。
AWS在租賃計算和存儲方面仍然引領全球雲計算。但這種領先優勢並未完全延伸到大規模人工智能訓練領域。一些開發者由於微軟與OpenAI的關聯而選擇依賴微軟。
其他人則轉向谷歌及其自主研發的芯片。亞馬遜現在正利用 Trainium3 將對價格敏感的團隊重新拉回其平臺。其核心理念是在 AWS 雲平臺上降低單位工作成本。
亞馬遜正大力推進 Trainium3 的雲規模化應用。
Trainium 3 的發佈距離亞馬遜部署上一代芯片大約一年。這樣的速度在芯片標準中屬於較快的水平。8 月份芯片首次啓動時,一位 AWS 工程師開玩笑說:“我們現在最希望的就是別冒煙或着火。” 這種快速升級的節奏也與英偉達公開的每年發佈一款新芯片的計劃相吻合。
亞馬遜表示,Trainium 芯片能夠以比英偉達頂級 GPU 更低的成本和更低的能耗運行 AI 模型背後的繁重計算任務。戴夫說:“我們對 Trainium 芯片在性價比方面的表現非常滿意。” 隨着模型規模的擴大和訓練成本的不斷攀升,亞馬遜正大力推進價格策略。
仍然存在侷限性。亞馬遜的芯片沒有像英偉達硬件那樣強大的軟件庫,無法讓團隊快速開發。Bedrock Robotics 公司利用人工智能技術實現無人駕駛工程機械,其主要系統運行在 AWS 服務器上。在訓練模型引導挖掘機時,它仍然使用英偉達芯片。Bedrock Robotics 的首席技術官 Kevin Peterson 表示:“我們需要它既高性能又易於使用。而這正是英偉達的優勢所在。”
目前,Trainium 芯片的大部分容量都流向了 Anthropic 公司。這些芯片運行在位於印第安納州、密西西比州和賓夕法尼亞州的數據中心內。今年早些時候,AWS 表示已連接超過 50 萬個 Trainium 芯片用於訓練 Anthropic 的最新模型。亞馬遜計劃在年底前將這一數字提高到 100 萬個。
亞馬遜將 Trainium 的未來與 Anthropic 的發展及其自身的 AI 服務緊密聯繫起來。除了 Anthropic 之外,該公司迄今爲止公佈的大型客戶寥寥無幾。這使得分析師缺乏足夠的數據來判斷 Trainium 在更廣泛應用場景下的表現。
Anthropic 也分散了自己的計算風險。它仍然使用谷歌的張量處理單元 (Tensor Processing Units),並且今年與谷歌簽署了一項協議,獲得了價值數百億美元的計算能力。
亞馬遜發佈了Trainium3。該大會已演變成一場不間斷的 AI 工具和基礎設施展示會,目標用戶包括構建新模型的開發者和願意付費大規模使用 AI 工具和基礎設施的公司。
亞馬遜推出 Nova 更新並開放 Nova Forge
週二,亞馬遜還更新了其主要人工智能模型系列 Nova。新的 Nova 2 系列包括一個名爲 Omni 的版本。
Omni 可接受文本、圖像、語音或視頻作爲輸入。它既可以返回文本,也可以返回圖像。亞馬遜將多種輸入類型和型號組合成一個套餐進行銷售,該套餐旨在滿足大規模日常使用需求。
亞馬遜繼續以性價比爲定價策略。以往的Nova系列機型在以固定問題答案爲評判標準的標準測試排名中並未名列前茅。該公司更注重實際使用體驗,而非測試圖表。
負責亞馬遜大部分模型工作和通用人工智能團隊的羅希特·普拉薩德表示,“真正的基準是現實世界”,並補充說,他希望新模型能夠在實際環境中展開競爭。
亞馬遜還通過名爲 Nova Forge 的新產品,向高級用戶開放了更深層次的模型控制,該產品允許團隊在訓練結束前提取 Nova 模型的版本,並使用自己的數據對其進行調整。
Reddit 已經在使用 Nova Forge 構建模型,用於檢查帖子是否違反安全規則。Reddit 首席技術官 Chris Slowe 表示,許多人工智能用戶傾向於爲每個任務構建儘可能龐大的模型,而不是針對特定領域進行訓練。“我們能夠讓它成爲我們特定領域的專家,這纔是其價值所在,”他說道。
隨着 Trainium3 在數據中心投入使用,Nova 模型也同步更新,亞馬遜正同時在兩個方面發力。硬件方面,他們與英偉達展開較量;模型方面,他們則與微軟支持的 OpenAI 和谷歌展開競爭。下一階段的重點是讓客戶在雲端進行實際應用。
不要只閱讀加密貨幣新聞。瞭解它。訂閱我們的新聞通訊。免費。










