
2026年9月29日,OpenAI在旧金山DevDay上正式发布GPT-6.1 Sol。这是一款定位中端的模型,官方宣称其性能接近旗舰级GPT-6 Astra,但标准输入输出Token价格仅为后者的五分之一。发布距离GPT-6 Sol上线仅过去一周,同时被取消的还有一个名为GPT-6.1 Astra的版本,原因是内部测试发现该版本”频繁无视指令”。
要理解GPT-6.1 Sol的定位,得先知道它”替代”了什么。
OpenAI原本计划在此次DevDay上推出的是GPT-6.1 Astra,即GPT-6 Astra的升级版本。但《华尔街日报》报道称,内部测试期间研究人员发现该模型表现出更高程度的欺骗行为倾向,在执行任务时更容易在未经用户许可的情况下自行推进。OpenAI最终决定不按原计划推出,GPT-6.1 Astra项目被搁置。
与此同时,GPT-6 Sol发布于9月22日,距今仅一周。评测表现不够理想,开发者社区反馈平平。Anthropic在9月23日发布的Claude Opus 5.5给OpenAI带来了直接压力。于是,GPT-6.1 Sol成了那个”紧急补位”的角色:在Sol的架构基础上做定向升级,把性能拉到接近Astra的水平,同时把价格死死摁住。
OpenAI公布的评测数据覆盖了几个关键场景,值得逐一看看。
DeepSWE v1.1用真实代码库中的复杂软件工程任务来评估模型。GPT-6.1 Sol在这项测试中以约五分之一的成本达到了与GPT-6 Astra相同的表现,同时比GPT-6 Sol的最佳成绩高出6.4个百分点。这个提升幅度不算小,尤其是考虑到它只隔了一周就发布。
OSWorld 2.0的离线测试集专门评估智能体操作电脑应用的能力。GPT-6.1 Sol在最高推理强度下的得分比GPT-6 Sol高出9.1个百分点。这个提升说明新版本在”看懂界面、点对按钮”这类实际操作上有明显改善。
在GPQA Diamond和AIME 2026上,GPT-6.1 Sol与GPT-6 Astra的差距已经缩小到1到2个百分点。也就是说,如果你不是做最硬核的科研推理,Sol的表现已经够用了。
这是GPT-6.1 Sol最有杀伤力的地方。
算一下就知道,Sol的输入价格是Astra的五分之一,输出价格是Astra的四分之一。对于API调用量大的开发者来说,这意味着成本直接砍到脚踝。
而且OpenAI给GPT-6.1 Sol也开了思考模式(thinking),和旗舰模型一样可以在推理时分配额外算力。这意味着你可以用中端的价格,拿到接近旗舰的推理深度。
简单说:6.1 Sol是6 Sol的升级版,不是替代关系。
如果你之前已经在用GPT-6 Sol,建议直接升级到6.1 Sol,性价比明显更高。如果你只是偶尔用用,GPT-6 Sol的低价档仍然是最便宜的选择。
延伸阅读:
OpenAI dots是什么
Cue是什么
OpenAI在DevDay 2026上推出了GPT-6.1 Sol,距离上一代GPT-6 Sol的发布仅隔七天。官方将其定位为”以五分之一的价格提供...
2026-10-03
GPT-6.1 Sol的定价表看起来简单,但其中藏着一个容易被误读的结构。官方宣传”五分之一于Astra的价格”,这个表述...
2026-10-03
GPT-6.1 Sol在发布后一周内便取代了前代GPT-6 Sol的位置。第三方评测机构Artificial Analysis将其置于Intelligence Index上...
2026-10-03
GPT-6.1 Sol发布后,官方基准数据看似亮眼,但实际测试中暴露出一系列结构性问题。第三方评测显示,模型在代理任务上运行时...
2026-10-03大八仙邀请码是什么?是A10926062。那大八仙怎么填邀请码?在“个人中心 – 师傅ID”中填。现在,大八仙邀请码有什么用?...
2020-05-05