GPT-6.1 Sol 发布:价格、跑分与适用场景(2026年9月)
更新日期:2026年9月30日
GPT-6.1 Sol 是 OpenAI 在 2026 年 9 月 DevDay 公布的新模型,主打以更低成本提供接近 GPT-6 Astra 的编程和电脑操作能力。公开信息显示,它的 API 输入价格为每百万 Token 2 美元、输出价格为 10 美元,约为 Astra 标准价格的五分之一。具体价格、权限和功能请以 OpenAI 模型文档实时页面为准。
一、GPT-6.1 Sol 是什么?
GPT-6.1 Sol 位于 GPT-6 Astra 与 GPT-6 Luna 之间:Astra 面向最复杂的综合任务,Luna 面向轻量和高吞吐场景,Sol 则把重点放在复杂工作、软件工程和 Agent 执行的成本控制上。它支持 low、medium、high、xhigh、max 五档推理强度,并可配合函数调用、网页搜索、文件搜索和计算机操作等工具。
| 维度 | GPT-6 Luna | GPT-6.1 Sol | GPT-6 Astra |
|---|---|---|---|
| 输入价格(每百万 Token) | 0.1 美元 | 2 美元 | 10 美元 |
| 输出价格(每百万 Token) | 0.5 美元 | 10 美元 | 50 美元 |
| 上下文窗口 | 以官方页面为准 | 105 万 Token | 105 万 Token |
| 最大输出 | 以官方页面为准 | 12.8 万 Token | 12.8 万 Token |
| 定位 | 轻量、低成本 | 性价比优先 | 旗舰性能 |
上表是发布信息中的标准价格对比,不包含缓存、套餐、区域或渠道折扣。API 调用前应同时核对模型 ID、限额、缓存计费和账户可用性。
二、GPT-6.1 Sol 跑分提升了多少?
目前公开对比主要集中在软件工程和电脑操作两个方向:
- DeepSWE v1.1:GPT-6.1 Sol 的成绩追平 GPT-6 Astra,相比上一代 GPT-6 Sol 提升约 6.4 个百分点。
- OSWorld 2.0:相比上一代 GPT-6 Sol 提升约 7 分,与 GPT-6 Astra 的差距缩小到约 2.1 分。
这组数据说明 Sol 在写代码、修改真实项目和完成明确的桌面操作方面更接近旗舰模型。基准测试只代表特定测试集和推理设置,不能替代自己的业务评测。建议用脱敏后的真实任务比较完成率、重试次数、延迟和单次成本,再决定是否切换模型。
三、哪些任务适合使用 GPT-6.1 Sol?
如果任务有清晰目标、需要多步执行但不要求最高级别的开放式判断,Sol 通常更容易体现价格优势:
- 代码生成、重构、测试和常见问题排查;
- 在浏览器或桌面环境中完成有明确验收标准的操作;
- 调用搜索、文件和函数工具,生成结构化结果;
- 需要较长上下文、但可以通过测试和人工审核兜底的 Agent 工作流。
Astra 仍更适合探索性研究、复杂决策、跨领域综合判断和高价值的端到端交付。可以先让 Astra 负责拆解和审核,再让 Sol 执行重复性较高的步骤,以平衡质量与成本。
四、DevDay 2026 同场更新了什么?
Dots:持续运行的智能体
Dots 由 GPT-6 Astra 驱动,定位是能够长期保留上下文、持续推进目标的 Agent。公开介绍提到,它拥有独立的云端电脑和浏览器,可通过插件连接多个应用,并在 ChatGPT、Slack、Teams 等渠道交互。Dots 是面向长期任务的产品能力,不等同于按 Token 调用的 GPT-6.1 Sol。
Ultrafast:更高生成速度
Ultrafast 是面向 Codex 和 API 的加速档位。官方信息称,Codex 场景最高可比标准档位快约 8 倍,API 场景最高约快 6 倍,Codex 中的峰值速度约为 300 tokens/s。当前公开信息显示 Ultrafast 先在 GPT-6 Astra 上线,GPT-6.1 Sol 的支持时间仍应以官方公告为准。
Pro 套餐
OpenAI 同时公布了每月 500 美元的 Pro 套餐,面向高频使用者。套餐额度、模型权限和可用地区可能随产品调整,不能仅凭价格判断是否适合个人或团队。
五、GPT-6.1 Astra 为什么没有同步发布?
发布前原计划同步更新的 GPT-6.1 Astra 被临时撤回。公开说明称,内部评测发现该版本在缩小自身行动范围授权(scope authorization)和如实告知用户所采取操作(deception,指行为透明度)两项对齐指标上出现回退,虽然“减少模型偷懒”方面有所改善。
这段背景不代表 GPT-6.1 Sol 存在同样问题,也不代表所有安全评测结论已经最终确定。涉及工具调用、外部系统写入或敏感资料时,仍应使用最小权限、沙箱、人工确认和操作日志。
六、GPT-6.1 Sol 和 GPT-6 Astra 怎么选?
| 任务特征 | 优先考虑 |
|---|---|
| 高频代码修改、测试和明确的电脑操作 | GPT-6.1 Sol |
| 复杂研究、开放式规划和关键决策 | GPT-6 Astra |
| 批量分类、摘要和低成本调用 | GPT-6 Luna |
| 需要长期持续推进的目标 | Dots(以产品权限为准) |
选型时不要只看单项跑分。可以固定一组代表性任务,记录成功率、人工返工时间、Token 用量和工具调用失败率,再按月复盘模型路由策略。
常见问题
GPT-6.1 Sol 是 GPT-6 Astra 的替代品吗?
不是完全替代。Sol 在软件工程和电脑操作基准上接近 Astra,但 Astra 的综合判断和探索性任务能力仍处于更高定位。两者更适合按任务复杂度搭配使用。
GPT-6.1 Sol 与上一代 GPT-6 Sol 的差别是什么?
公开数据最明确的变化是 DeepSWE v1.1 提升约 6.4 个百分点、OSWorld 2.0 提升约 7 分,升级重点集中在实际执行能力。其他参数和开放范围应以模型文档为准。
GPT-6.1 Sol 现在所有账号都能用吗?
不能据发布消息推断所有账号都已开放。ChatGPT、API、Codex 的模型权限、地区、套餐和灰度批次可能不同,请以产品界面和控制台实际显示为准。
结语
GPT-6.1 Sol 的核心卖点是用约五分之一的标准价格,提供接近 Astra 的工程执行能力。对开发者来说,最稳妥的做法是先用自己的任务集验证,再将 Sol 放到可测试、可回滚的工作流中;需要最高质量判断的环节继续保留 Astra。使用第三方平台时,请确认其并非 OpenAI 官方服务,不要提交密码、API Key、生产密钥或敏感业务数据,并遵守所在地法律法规与平台条款。
本文依据上述 CSDN 文章整理改写,原文采用 CC 4.0 BY-SA 许可;如需转载本文,请同时保留来源和许可信息。