Anthropic 最新款 Fable 5.1 型號躍居 LLM 排行榜榜首
Anthropic 於 9 月 1 日發佈了一款名爲 Claude Fable 5.1 的新型號。.
該模型立即在人工智能分析網站的智能排行榜上佔據了第一名的位置,在該網站的指數中獲得了 66 分,並在此過程中取代了 Opus 5。.
《神鬼寓言5.1》和《Opus 5》位居排行榜榜首。
Artificial Analysis 超過 250 種語言模型的 價格、速度和智能程度進行了排名。目前,Fable 5.1 的兩個版本分別位列第一和第二。該網站對“帶回退機制的 max 版本”的評分爲 66 分,對“帶回退機制的 xhigh 版本”的評分爲 65 分。
這兩款遊戲都遠超前領頭羊 Claude Opus 5,其最高分和超高分模式的得分均爲 63 分。.
這意味着 Anthropic 的模型佔據了排行榜前四名,該排行榜還包括來自 OpenAI、Google、SpaceXAI、阿里巴巴和 DeepSeek 等頂級人工智能實驗室的模型。與 Anthropic 模型最接近的是 OpenAI 的 GPT-5.6 Sol(最高模式)和 SpaceXAI 的 Grok 4.6,它們的得分均爲 61 分。.

該排名來自dent 機構,因此比實驗室自己的圖表更具有效性。.
編碼和研究成績最終結果如何?
Anthropic 的內部數據也印證了這一點,儘管這些數據應被視爲廠商報告。Anthropic 的報告 顯示,Fable 5.1 在 Terminal-Bench-Science 0.1 測試中取得了 52.6% 的成績,該測試旨在評估智能體科學研究的能力。這一 數字 是 Fable 5 成績(24.7%)的兩倍,並且遠高於 Opus 5 的 29% 和 GPT-5.6 Sol 的 22.4%。
Fable 5.1 在 Terminal-Bench 4.0 編碼基準測試中得分 55.8%,高於 Fable 5 的 42.0%。.
這款新機型的賣點在於其能夠長時間運行。Millennium 公司告訴 Anthropic 公司,Fable 5.1 能夠 trac到其系統中一次罕見的崩潰,而這次崩潰的根源在於一個過去四五年來一直困擾着工程師的頑固漏洞。.
Browserbase 表示,新模型在其最難的瀏覽器代理測試中完成了 82% 的任務,而 Opus 5 的完成率爲 74%。.
緩存讀取價格降低 75%
不過,價格並沒有變化。Fable 5.1 仍然沿用了 Fable 5 的價格,即每百萬輸入代幣 10 美元,每百萬輸出代幣 50 美元,遠高於 Opus 5(每百萬輸入代幣 5 美元,每百萬輸出代幣 25 美元)和 Sonnet 5(每百萬輸入代幣 2 美元,每百萬輸出代幣 10 美元)。.
此次調整涉及緩存上下文的價格。Anthropic 將緩存讀取價格從每百萬代幣 1.00 美元降至 0.25 美元,降幅達 75%。.
Anthropic公司估計,平均工作負載成本將降低25%,而高度依賴智能體的工作負載成本將降低45%。這是因爲智能體能夠重讀相同的代碼、指令和對話歷史記錄。.
同一模型,兩層安全保障
Anthropic公司推出了第二個版本,名爲Fable 5.1: Claude Mythos 5.1。它們本質上是相同的模型,但安全防護措施有所不同。Fable 5.1面向公衆開放,而Mythos 5.1僅通過Anthropic公司的Project Glasswing項目提供給經過審覈的網絡安全和生命科學機構。
此次分裂發生 在Anthropic安全測試 Cryptopolitan 報道的那樣,Anthropic於7月23日暫停了外部網絡安全評估。此前,Claude在原本應在沙盒環境中進行的測試中入侵了真實系統。 經歷一段艱難時期之後。正如
公司 在採取適當的遏制措施後,恢復了外部網絡安全評估。
最頂尖的加密貨幣專家都在閱讀我們的簡報。想 加入他們?











