OpenAI推出GPT-6.1 Sol与Dot智能体:性能逼近Astra,成本大幅下降
OpenAI发布GPT-6.1 Sol模型及Dot智能体。Sol旨在平衡高性能与低成本,其编程、文档处理和计算机使用能力接近Astra,但标准Token价格大幅降低,适合规模化部署。由Astra驱动的Dot则作为全天候云端智能体亮相,支持多应用集成与自主项目推进,目前正向高级别套餐用户逐步推出。

TradingKey - OpenAI宣布推出GPT-6.1 Sol,这是GPT-6 Sol的升级版本,重点提升智能体编程、计算机使用和专业工作能力。OpenAI表示,GPT-6.1 Sol在多项评测中接近GPT-6 Astra的表现,但标准输入和输出Token价格约为Astra的五分之一。此外,智能体Dot也同步亮相。
该模型的标准API价格为每百万输入Token 2美元、每百万缓存输入Token 0.10美元、每百万输出Token 10美元。其中,缓存输入价格比标准输入低95%,主要面向需要反复复用上下文的智能体工作负载。
GPT-6.1 Sol瞄准“高性能与低成本”平衡
OpenAI表示,GPT-6 Astra仍是其综合能力最强的前沿模型,适合最复杂的科学研究和专业任务。GPT-6.1 Sol则试图在性能与成本之间提供更适合规模化部署的方案。
在DeepSWE v1.1代码评测中,GPT-6.1 Sol以约五分之一的成本达到接近GPT-6 Astra的水平。在较低推理强度和成本下,其得分还比GPT-6 Sol的最高成绩高出6.4个百分点。
在GDP.pdf专业文档评测中,GPT-6.1 Sol在测试的不同推理设置下均取得高于带回退机制Opus 5.5的成绩,单任务成本不到后者的一半。与GPT-6 Astra接近的表现,单任务成本约为Astra的五分之一。
多项评测显示性能提升
在计算机使用任务中,GPT-6.1 Sol与GPT-6 Astra的得分差距缩小至2.1个百分点以内,但单任务成本约为Astra的七分之一。
在科学研究评测中,GPT-6.1 Sol最高推理强度下的平均单任务成本为5.47美元,低于Opus 5.5的23.21美元和GPT-6 Astra的23.80美元。GPT-6 Astra仍以68.1%的得分位列受测模型第一,OpenAI建议将其用于最具挑战性的科学研究任务。
OpenAI同时披露,GPT-6.1 Sol在高难度事实准确性测试中的事实错误率为4.1%,比GPT-6 Sol低0.4个百分点,单任务成本则比Astra低约83%。不过,该测试使用的是经过筛选的高难度对话,并不代表典型用户场景。
OpenAI推出Dot:全天候运行的AI智能体
与Sol同时亮相的还有智能体Dot。据公告,Dot由GPT-6 Astra驱动,拥有独立的云端电脑,能在长期使用中从反馈里学习,全天候为用户目标工作,并可通过插件生态连接4000多款应用。用户可通过ChatGPT、短信、Slack和Teams随时联系Dot,也可与其语音通话,Dot会在各渠道间同步上下文。
Dot具备独立的身份与权限管理,使用云端电脑和自己的浏览器,需要时可编写和测试代码;用户可随时打开Dot的电脑检查其工作,也可授权它连接自己的笔记本电脑。Dot可同时自主推进多个项目,无需在不同对话间切换或逐步指导。OpenAI举例称,一位早期测试者的Dot发现其忘记给一家出版机构开具发票,便准备好发票并在获得批准后发送。
Dot正向符合条件的市场的Pro、Business Premium和Enterprise套餐用户逐步推出;OpenAI同时面向少量企业开放专职Dot预览版,后者在组织内拥有独立身份和明确职责。Pro用户可加入名额有限的候补名单,申请通过iMessage和RCS收发消息。











