馬斯克承認 Grok 4.7 落後於 Anthropico 和 OpenAI 的最新模型;承諾 Grok 5 將實現通用人工智能。
埃隆·馬斯克甚至在 xAI 的 Grok 4.7 模型發佈之前就降低了人們對它的期望,他在 X 的帖子中承認,該模型與 Anthropic 的 Opus 5.0 相比,比與更新的 Opus 5.1 模型、Fable 甚至 OpenAI 的 Astra 相比,更接近。.
馬斯克還表示,多模式運營仍需改進。這些坦白,以及實際的運營表現,與這位特斯拉CEO在產品上市前慣用的誇張宣傳截然不同。.
馬斯克對 Grok 4.7 有什麼評價?
針對有關 Grok 4.7 與競爭對手相比如何的問題, 馬斯克回應 說,它“應該大致與 Opus 5.0 相當,而不是 5.1”。這位 SpaceX 首席執行官補充說,它“在某些方面更好,在另一些方面更差”。
馬斯克 週五解釋 說,Grok 4.7還需要“幾天時間來完善”,因爲團隊似乎在強化學習過程中對反應長度的懲罰過重。結果,新模型“過早地放棄了它能完成的難題!”,而且它自我檢查的能力尚未達到所需水平。
原定於9月12日發佈的Grok 4.7模型 據稱是一個包含約2.1萬億個參數的模型,並輔以SpaceX的工程數據。如果這些報道屬實,那麼最新模型的參數量將比Grok 4.6(據 報道 約爲1.5萬億個參數)大40%。
第三方 對 Anthropic 的 Claude Fable 5.1 的評估報告 顯示,其在 Terminal-Bench-Science 上的得分爲 52.6%,公佈的價格爲每百萬個輸入代幣 10 美元,每百萬個輸出代幣 50 美元。
尚未發佈的 Grok 4.7 目前尚無已確認的基準測試分數或代幣定價。截至本文撰寫之時,其價格可能比競品便宜 10 倍的說法仍未經證實。.
馬斯克已經承諾會推出通用人工智能(AGI)。
馬斯克很快就回到了他雄心勃勃的帖子中,勾勒出一個快速發佈計劃,以跟上尚未發佈的 4.7 型號。.

Grok 4.8是一個擁有 2.5 萬億個參數的模型,它基於 xAI 的全新 C 軟件棧進行訓練,將於本週完成訓練,然後開始強化學習。他稱其相比 4.7 版本“有了顯著改進”。
馬斯克隨後聲稱,Grok 4.9 很可能達到“Astra/Fable 級別”,指的是 OpenAI 的 GPT-6 Astra 和 Anthropic 的 Fable 系列。他 表示, 目前 2.5 萬億參數的模型比之前使用 Jax 訓練的 2.1 萬億參數版本更好,後者存在一些“僅在運行過程中才糾正”的錯誤。他還指出,即將進行一次 3 萬億參數的運行,屆時將使用升級後的內部訓練軟件和更乾淨的數據。
更重磅的消息留給了最頂級的產品。馬斯克說Grok 5“或許比任何產品都好”,但他又補充道“我們拭目以待”。在另一次回覆用戶詢問某項具體功能將由哪款產品實現時, 他只回答說:“那就是Grok 5。”
馬斯克沒有給出發佈日期,也沒有提供除此斷言之外的任何證據。目前,可衡量的基準仍然是 Grok 4.6,而馬斯克自己提到的需要超越的標杆模型——Opus 5.1 和 OpenAI 的 Astra——已經上市,Grok 4.7 則仍在等待發布。.
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?









