AI+ 2026-09-22

GPT-6.1 Sol:用五分之一的价格逼近旗舰 Astra

2026 年 9 月 22 日,OpenAI 发布 GPT-6.1 Sol——中坚款 Sol 的升级版,官方口号是「以约 1/5 的价格提供接近 Astra 的智能」。该发布在 OpenAI DevDay(9/29)期间被重新聚焦,再度冲上 Hacker News 首页(760+ 分),成为本周「模型性价比」讨论的中心。

关键数据(vs GPT-6 Sol 与 Astra、Opus 5.5)

  • 编程:DeepSWE v1.1 上追平旗舰 Astra、成本约为其 1/5;同时在更低推理档位与成本下,反超 GPT-6 Sol 最佳成绩 6.4 个百分点;
  • 专业文档工作:GDP.pdf(基于复杂 PDF 的专业问答,覆盖金融/医疗/法律等九个领域)得分超过 Opus 5.5(含 fallback),每任务成本不到其一半;
  • 业务自动化:AutomationBench 上中等推理档位反超 Opus 5.5 2.2 个百分点、成本约为其 1/3;较 GPT-6 Sol 同档提升 4.8 个百分点;
  • 计算机使用:OSWorld 2.0 离线集在最高档位较 GPT-6 Sol 提升 7 个百分点,与 Astra 的差距缩至 2.1 个百分点(成本约 1/7);
  • 科研:Terminal-Bench Science 上得分较 GPT-6 Sol 翻倍以上;每任务平均 $5.47,对比 Opus 5.5 的 $23.21 与 Astra 的 $23.80(低 75% 以上;Astra 仍保持最高分 68.1%);
  • 事实性:困难提示下的事实错误率从 GPT-6 Sol 的 11.4% 降至 7.7%(约 -32%);各档位错误率与 Astra 差距在 1.9 个百分点以内。

定价与可用性

API 模型名 gpt-6.1-sol:$2 输入 / $10 输出每百万 token,缓存输入仅 $0.10——比标准输入便宜 95%,比 GPT-6 Sol 的缓存价再降一半,明显在为「跨请求复用上下文的常驻 Agent」铺路。即日面向 ChatGPT Plus/Pro/Business/Enterprise/Edu 用户在 ChatGPT Work 与 Codex 开放(Chat 暂不可用);未来几天还将推出 Ultrafast 模式(生成速度最高 8 倍)。

对企业的启示

  1. 1缓存价格是给 Agent 时代的定价信号:$0.10 的缓存读取价 + 上周 GPT-6 系列的「调档不破缓存」改进,OpenAI 在系统性地鼓励常驻式、多轮复用的 agent 架构——新建工作流时应默认按「缓存友好」设计;
  2. 2性价比曲线继续陡降:DeepSWE 追平 Astra 的 1/5 成本意味着「接近旗舰」的门槛价格一个月内又降了一档,季度性的模型基线重评从建议变成必需;
  3. 3ProMen 为企业维护「多模型路由 + 季度基线重评」的 AI 工作流方案。如果您的自动化管线超过三个月没换过模型配置,欢迎与我们做一次成本体检。

继续阅读