tradingkey.logo
搜尋

React專項實測:GPT-5.6 Sol第一,但最好成績僅43.1%

金色財經2026年7月16日 11:18
facebooktwitterlinkedin

7月16日消息,專做 React 開發工具的 Million 團隊推出 ReactBench v1,測試 AI 編程 Agent 能否完成真實的 React 開發任務,並避免引入新的代碼問題。 React 是用於構建網站和 App 界面的主流 JavaScript 庫。Million 此前開發了 React Scan、React Doctor 和 Million.js 等開源工具。 ReactBench 從開源項目中篩出 51 項真實任務。除了檢查功能能否運行,它還用 400 多條規則排查程序錯誤、性能、無障礙和代碼質量問題。 GPT-5.6 Sol 以 43.1% 的綜合得分居首,Fable 5 爲 41.2%。官方稱兩者差距較小,暫時無法確認 Sol 明顯更強。同爲 XHigh 配置時,Fable 5 的單次測試成本約爲 Sol 的 6.3 倍。 即使是成績最高的配置,成功完成的任務也不到一半。在 4455 次新功能開發測試中,各模型共引入 1194 個 React 問題,其中 77.5% 是程序錯誤或安全問題。

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。

推薦文章

tradingkey.logo
風險提示:我們的網站和行動應用程式僅提供關於某些投資產品的一般資訊。Finsights 不提供財務建議或對任何投資產品的推薦,且提供此類資訊不應被解釋為 Finsights 提供財務建議或推薦。
投資產品存在重大投資風險,包括可能損失投資的本金,且可能並不適合所有人。投資產品的過去表現並不代表其未來表現。
Finsights 可能允許第三方廣告商或關聯公司在我們的網站或行動應用程式的任何部分放置或投放廣告,並可能根據您與廣告的互動情況獲得報酬。
© 版權所有: FINSIGHTS MEDIA PTE. LTD. 版權所有