模型發佈 | 谷歌最早將於週三發佈 Gemini 3.8 Flash AI模型,編程能力大幅升級
據員工透露,谷歌(Google)的人工智能研究部門即將發佈一款編程能力大幅升級的新模型,這可能幫助該公司彌補在這一領域落後於OpenAI和Anthropic競爭對手的差距。
知情人士稱,這款模型名爲3.8 Flash,在公司內部被稱爲“Skimaki”,最快將於週三發佈。
其中一些人士表示,在谷歌內部編程工具Jetski的直接對比測試中,公司工程師更傾向於使用這款模型,而非Anthropic的Opus模型。
如果3.8 Flash能在行業標準基準測試中取得強勁表現,可能有助於回答外界自谷歌DeepMind聯合創始人Demis Hassabis上月在一次高管調整中退居二線之前,就一直存在的一些疑問。
Hassabis的繼任者Koray Kavukcuoglu已向員工強調,他希望提高執行速度。
去年11月發佈Gemini 3.0後,谷歌曾短暫成爲模型開發競賽的領先者之一,但今年以來遭遇了一系列挫折。
在AI智能體編程成爲AI最主要商業應用場景之際,Gemini重新落後於Anthropic和OpenAI的旗艦模型。谷歌的一些高知名度研究人員,包括Character AI聯合創始人Noam Shazeer和首席科學家Jeff Dean,也於今年夏初離職。
3.8 Flash如果表現強勁,僅憑這一點可能也不足以讓外界認爲谷歌重新確立了其在所謂“前沿模型”領域的地位。
Flash系列模型的設計目標是體積更小、成本更低、運行速度更快,但其能力不及規模最大的模型。後者包含數萬億個數值參數。
儘管谷歌首席執行官Sundar Pichai在5月表示,新款Pro系列模型將於“下個月”發佈,但谷歌功能最強大的Pro系列新模型目前已經落後於原定時間表數月。
知情人士稱,內部原本作爲3.5 Pro候選版本的模型因沒有明顯優於Flash系列而被放棄。
據知情人士透露,谷歌下一款旗艦模型Gemini 4在預訓練評估中表現良好,但仍需要完成後訓練。
知情人士稱,Flash模型規模較小,因此調整模型所需的計算能力更少,這使得多個團隊可以同時嘗試不同方法並進行開發。
相比之下,對谷歌規模更大的Pro模型進行調整,需要調動更多的公司資源。
知情人士表示,在谷歌DeepMind及其他實驗室內部,研究團隊一直同時推進多個不同方向的研發項目,因此某一款正在開發的模型表現落後,並不一定意味着其他即將推出的模型也會受到影響。
部分知情人士稱,谷歌近期的3.7 Flash和3.8 Flash模型已經開發了數月,其研發早在上月的領導層調整之前就已開始。
DeepMind員工表示,至少從去年開始,Kavukcuoglu一直負責Gemini開發的日常決策,而Hassabis則將大量時間投入到外部活動中。
Business Insider此前報道稱,谷歌員工一直在測試3.8 Flash。
自今年年初以來,谷歌一直投入更多研究人員時間和計算資源,以提升模型的編程能力。
知情人士稱,谷歌尤其增加了對強化學習的資源投入。強化學習是訓練過程後期的一項步驟,通過試錯的方式訓練模型掌握相關技能。
谷歌近期聘請Barret Zoph擔任研究副總裁,負責強化學習和後訓練業務。Zoph此前是Thinking Machines Lab聯合創始人,也是OpenAI負責後訓練工作的負責人。










