阿里巴巴計劃訓練5萬億至10萬億參數AI模型,併發布新一代芯片
阿里巴巴集團週二表示,公司計劃訓練一個擁有5萬億至10萬億參數的新人工智能模型。阿里巴巴首席執行官吳泳銘當天還公佈了涵蓋AI模型、芯片和數據中心的整體發展計劃。
吳泳銘在杭州舉行的阿里雲年度Apsara大會上表示,通義千問團隊正在繼續研究模型架構和數據優化,希望讓AI完成“更復雜、更長期的任務”,並進一步向人工超級智能(ASI)發展。
阿里巴巴在另一份聲明中表示,下一代模型Qwen 4目前正在訓練中,後續的Qwen 4.5和Qwen 5系列預計將把模型規模擴大至5萬億至10萬億參數。
參數是AI模型在訓練過程中學習的變量數量,通常可以作爲衡量模型規模的一個指標。阿里巴巴目前的旗艦模型Qwen 3.8 Max擁有2.4萬億參數,這意味着計劃中的新模型規模將達到目前模型的約2至4倍。
吳泳銘表示,阿里巴巴自研的M890 AI超級節點目前已經能夠處理超過2萬億參數模型的推理任務,他稱全球具備這一能力的公司只有“少數幾家”。
吳泳銘還表示,通義千問團隊在“遞歸自我改進”方面已經取得進展,即模型能夠識別自身侷限、設計實驗並生成數據,從而推動自身能力不斷提升。
阿里發佈新一代AI芯片
阿里巴巴旗下半導體部門平頭哥還發布了下一代AI芯片“真武V900”。吳泳銘稱,這是中國目前性能最強的AI芯片。
據阿里巴巴介紹,真武V900的性能是上一代M890的3倍。由該芯片組成的單個集羣最多可支持50萬張芯片卡,用於前沿AI模型的訓練和推理。
阿里巴巴表示,真武V900計劃於2027年第一季度量產並正式商用。上一代M890於今年5月發佈。
吳泳銘預計,阿里巴巴AI芯片的年出貨量將大幅增長。
此次新芯片發佈之際,中國科技企業正加快開發英偉達處理器的國產替代方案,美國對先進芯片的出口限制也進一步推動了這一趨勢。
阿里雲計劃擴大數據中心規模
在數據中心方面,吳泳銘表示,阿里雲計劃到2032年將全球數據中心容量擴大至超過20吉瓦。
他表示,客戶對AI的需求仍然“非常強勁”,並正在推動阿里雲收入增長,但全球AI數據中心供應鏈的短缺限制了公司擴張速度。
吳泳銘表示:“行業中長期需求遠遠超過我們的供應能力。”阿里雲將從今年第三季度開始,在商業規模上陸續啓用AI超級節點。







