MiniMax發佈H3視頻生成模型,多模態能力升級加劇中國AI視頻競爭
MINIMAX-W週五發佈新一代視頻生成模型H3,支持文本、圖片、視頻和音頻等多模態輸入,進一步加劇與字節跳動、快手等公司在AI視頻生成領域的競爭。
MiniMax表示,H3可生成最長15秒、2K分辨率的視頻,並支持原生立體聲音頻輸出。該模型還具備視頻編輯和動作遷移能力,可根據用戶提供的文本指令及參考圖片、視頻等素材,對現有內容進行修改,或將一個視頻中的動作遷移至另一個視頻。
值得關注的是,MiniMax計劃在未來幾天內開放H3模型權重,允許開發者下載並定製底層模型。這意味着中國AI開發者正在將“開放權重(Open Weight)”模式進一步擴展至視頻生成領域,而目前國際上許多主流視頻模型仍採用閉源方案。
MiniMax成立於2022年,是中國“AI六小虎”之一,主要與國內互聯網大廠以及OpenAI等國際AI公司競爭基礎模型市場。今年1月,公司在香港上市,成爲繼智譜(Z.AI)之後第二家完成公開上市的“AI六小虎”企業。
路透社此前報道稱,MiniMax計劃於7月底發佈H3模型,並正在研發一款參數規模達2.7萬億的語言模型。
近年來,中國AI視頻模型競爭明顯升溫。字節跳動今年推出Seedance 2.0,憑藉文本、圖片、音頻和視頻融合生成能力引發市場廣泛關注;快手此前也發佈了Kling 3.0,進一步推動視頻生成模型迭代升級。
MiniMax表示,H3主要面向廣告、電商、產品設計和遊戲等商業應用場景,並稱其2K視頻生成成本低於主流競爭產品的三分之一。
此外,在中國AI產業加快降低對美國半導體依賴的背景下,MiniMax表示,H3已針對多款國產AI芯片進行適配,以提升國產算力平臺的兼容性和部署能力。
7月31日午間, MINIMAX-W港股漲超12%。

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。
讚









