tradingkey.logo
搜索

React专项实测:GPT-5.6 Sol第一,但最好成绩仅43.1%

金色财经2026年7月16日 11:18
facebooktwitterlinkedin

7月16日消息,专做 React 开发工具的 Million 团队推出 ReactBench v1,测试 AI 编程 Agent 能否完成真实的 React 开发任务,并避免引入新的代码问题。 React 是用于构建网站和 App 界面的主流 JavaScript 库。Million 此前开发了 React Scan、React Doctor 和 Million.js 等开源工具。 ReactBench 从开源项目中筛出 51 项真实任务。除了检查功能能否运行,它还用 400 多条规则排查程序错误、性能、无障碍和代码质量问题。 GPT-5.6 Sol 以 43.1% 的综合得分居首,Fable 5 为 41.2%。官方称两者差距较小,暂时无法确认 Sol 明显更强。同为 XHigh 配置时,Fable 5 的单次测试成本约为 Sol 的 6.3 倍。 即使是成绩最高的配置,成功完成的任务也不到一半。在 4455 次新功能开发测试中,各模型共引入 1194 个 React 问题,其中 77.5% 是程序错误或安全问题。

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有