OpenAI DevDay 2026推出GPT-6.1 Sol:旗舰级能力,成本直降80%,支撑智能体规模化落地

作者: 李祥敬

责任编辑: 李祥敬

来源: CBISMB

时间: 2026-09-30 10:09

关键字: 大模型 ,OpenAI ,GPT

浏览: 0

点赞: 0

收藏: 0

当地时间9月29日,OpenAI DevDay 2026大会上,除全天候智能体Dots之外,另一核心产品GPT-6.1 Sol正式亮相。作为GPT-6 Sol的迭代升级版本,它定位为开发者日常主力模型,在代码工程、专业文档、计算机操作等任务上逼近旗舰GPT-6 Astra,而token调用价格仅为后者的五分之一,一举解决智能体开发成本高昂的痛点,为Dots这类Agent产品铺好了算力底座。

GPT-6.1 Sol的核心优势集中在复杂任务推理、代码能力与事实准确性三大维度。在代码基准测试DeepSWE v1.1中,面对真实代码库的长周期软件工程任务,GPT-6.1 Sol表现与GPT-6 Astra基本持平;相比前代GPT-6 Sol,在低推理强度场景下得分提升6.4个百分点,大幅降低开发场景的使用成本。在OSWorld 2.0计算机操作评测中,模型可以独立操作浏览器、执行多步骤自动化工作流,和Astra仅有2.1分差距,单任务成本仅为Astra的约七分之一。

针对专业场景,GPT-6.1 Sol对长PDF文档解读、多环节业务流程自动化、科研数据分析等工作同样擅长。在GDP.pdf专业文档测试集,它的表现优于Opus 5.5,单任务成本不足后者一半。模型还优化了事实准确性,高难度提示词场景下事实错误率降至4.1%,与Astra的4.0%差距极小;低推理强度模式下,相比前代GPT-6 Sol,事实错误率从11.4%下降至7.7%,幻觉问题得到明显收敛。同时模型对齐能力增强,能够清晰识别自身能力边界,当工具调用失败时主动告知用户,而非强行编造结果,非常适合需要稳定可靠输出的智能体场景。

定价策略是GPT-6.1 Sol最大杀手锏。API标准定价:输入$2/百万token,输出$10/百万token,缓存输入低至$0.1/百万token,缓存价格相比标准输入优惠95%,对需要反复读取上下文的Agent任务十分友好。对于开发者而言,同等预算下,可以部署更多Dots智能体、运行更长的自动化任务,不用再为高额模型调用成本受限。OpenAI还预告后续将上线GPT-6.1 Sol Ultrafast极速版本,Codex环境最高可提速8倍,生成速度可达300token/s,兼顾速度与成本。

目前GPT-6.1 Sol已经上线API,面向ChatGPT Plus、Pro、Business Premium、Enterprise及教育版用户开放,可直接用于Codex代码开发、ChatGPT Work和Dots智能体的底层推理。

作为对比,GPT-6 Astra仍是OpenAI的绝对旗舰,在最极限、超高复杂度的推理任务上保持领先,适合少量、高价值的单点任务。但Astra高昂的价格,难以支撑大规模、长时间持续运行的智能体集群。GPT-6.1 Sol的出现,填补了旗舰模型与通用模型之间的空白:不再是零星调用AI,而是可以批量部署持续运行的Agent。

从行业视角看,GPT-6.1 Sol的发布,标志着大模型竞争从单纯比拼基准跑分,转向性能、成本、Agent适配能力综合比拼。此前开发者想要搭建具备电脑操作、长流程规划能力的智能体,只能选择顶级旗舰,成本门槛极高。GPT-6.1 Sol把接近旗舰的能力下放到可规模化使用的价位段,让Dots这类全天候智能体从演示原型走向商用落地。

当然,GPT-6.1 Sol并非全能,面对最高难度的前沿科研、复杂法律推演等极限场景,旗舰Astra依旧是首选。但对于绝大多数企业自动化、软件开发、文档处理、持续Agent任务,GPT-6.1 Sol已经足够胜任。当模型成本大幅下降,稳定度持续提升,智能体大规模普及的时代,才真正拉开序幕。

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。
地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除

京ICP备:2022009079号-2

京公网安备:11010502051901号

ICP证:京B2-20230255