OpenAI 推出低成本模型 GPT-6.1 Sol:每百万 token 输入 2 美元、输出 10 美元,面向智能体自动化

OpenAI 推出低成本模型 GPT-6.1 Sol:每百万 token 输入 2 美元、输出 10 美元,面向智能体自动化
摘要:一个模型的价格能压到什么程度,决定了它能被用在什么场景。OpenAI 在 2026 年 9 月 29 日的 DevDay 2026 上发布 GPT-6.1 Sol,官方对它的定位写得很直白:以 GPT-6 Astra 五分之一的标准 token 价格,提供接近...

OpenAI 推出低成本模型 GPT-6.1 Sol:每百万 token 输入 2 美元、输出 10 美元,面向智能体自动化

一个模型的价格能压到什么程度,决定了它能被用在什么场景。OpenAI 在 2026 年 9 月 29 日的 DevDay 2026 上发布 GPT-6.1 Sol,官方对它的定位写得很直白:以 GPT-6 Astra 五分之一的标准 token 价格,提供接近 Astra 的智能体编码、电脑操作与专业工作能力。

价格是硬的。OpenAI 官方发布说明写明:对于输入不超过 27.2 万 token 的提示词,每 100 万 token 的标准价格为输入 2 美元、缓存输入 0.10 美元、缓存写入 2.50 美元、输出 10 美元。作为对照,GPT-6 Astra 的价格是输入 10 美元、缓存输入 1 美元、输出 50 美元。

需要先把一个日期修正过来:GPT-6.1 Sol 的发布时点是 2026 年 9 月 29 日的 DevDay,不是 10 月。10 月陆续落地的是 Ultrafast 加速档位与 Pro 500 订阅档,容易与模型本身的发布日期混淆。

一、2 美元与 10 美元的完整口径

价格必须带前提读。OpenAI 发布说明的限定条件是「输入不超过 272K token 的提示词」,超出这一长度的提示,输入输出按更高档计费。

在这个范围内:输入 2 美元/百万 token,缓存输入 0.10 美元/百万 token,缓存写入 2.50 美元/百万 token,输出 10 美元/百万 token。GPT-6.1 Sol 同时支持多智能体(Multi-agent)的beta 能力,允许模型在一次 Responses API 请求中把工作委派给子智能体。

缓存输入这个价格值得单独看。0.10 美元相当于标准输入价的 5%,也是 GPT-6 Sol 缓存价的一半。对长时间运行、反复携带同一份上下文的智能体会话来说,缓存命中率直接决定账单,这个价目比输入输出价更能影响实际成本。

二、官方横向对比数据,需要标注是自测

OpenAI 公布了一组评测结果,全部应当作为「厂商自述」理解——其中自家模型在自己的研究环境或通过自家 API 测试,竞品模型的成绩取自公开报告,两者并非同一条件下跑出。

按官方说法:在考察真实代码库长流程软件工程任务的 DeepSWE v1.1 上,GPT-6.1 Sol 可以匹配 GPT-6 Astra,成本约为其五分之一,同时比 GPT-6 Sol 的最好成绩高 6.4 个百分点;在测试多步业务工作流的 AutomationBench 上,比 Anthropic 的 Opus 5.5 高 2.2 个百分点,成本约为三分之一;在 OSWorld 2.0 的 computer-use 测试集上,比 GPT-6 Sol 高 7 个百分点,与 Astra 的差距在 2.1 个百分点以内,单任务成本约为七分之一。

在 Terminal-Bench Science 0.1 上,官方给出的单任务平均成本是 GPT-6.1 Sol 5.47 美元,Opus 5.5 为 23.21 美元,Astra 为 23.80 美元。OpenAI 同时说明,Astra 仍是受测模型中得分最高的,为 68.1%,最难的科学科研任务仍应使用 Astra。

错误率方面,官方称在低推理强度下,含事实性错误的回答占比从 GPT-6 Sol 的 11.4% 降到 7.7%。在一项测试中,模型未告知用户搜索工具故障的比例为 2.1%,GPT-6 Sol 为 4.9%,Astra 为 1.5%。OpenAI 说明这些测试刻意选择了容易失败的任务,不代表典型使用情况。

核心数据一览

三、开放范围:先 Pro,再逐级放开

可用性分两条线。API 侧,开发者以 gpt-6.1-sol 调用。产品侧,OpenAI 发布说明写的是:正在 ChatGPT Work 和 Codex 中逐步推出,先向 Pro 用户开放,再扩展至 Plus、Business、Enterprise 和 Edu 用户。Enterprise 与 Edu 工作区拥有者需要在「工作区设置 > 权限与角色」中自行开启模型访问权限。

一个容易踩的坑:该模型尚未在常规 ChatGPT 对话(Chat)中提供。订阅了 Plus 但只在聊天窗口找模型选择器的用户,是找不到它的。

四、3500 万周活的口径是「合计」

同期披露的用户数据来自 DevDay 2026:ChatGPT 每周活跃用户超过 12 亿;ChatGPT Work 与 Codex 的每周用户超过 3500 万;使用 OpenAI 产品的企业达到 250 万家。

3500 万这个数字需要注意口径。它是 ChatGPT Work 与 Codex 的合计周活跃用户,不是两个产品各自 3500 万;OpenAI 没有公布两个产品之间的重叠度、地域分布或留存曲线。作为对照,OpenAI 在 6 月曾称 Codex 单独有超过 500 万周活跃用户。

换句话说,3500 万说明「从对话转向委派任务」这件事在起量,但不说明这些用户的使用深度。

趋势与结构拆解

五、对卖家侧意味着什么,以及不意味着什么

按 token 计价的成本下降,会直接传导到自建智能体工作流的单位成本上。刊登生成、客服问答、广告报表解读这类任务,共同特点是上下文重复度高、单次输出不长——恰好是缓存输入降价受益最大的那类负载。同样的预算,现在可以跑更多次迭代,或者在同一个任务上多做一轮自查。

同时不要把单次调用价格与整体工作流效果混为一谈。价格下降改变的是「可以试多少次」,不改变「一次能不能做对」。一个自动化刊登流程如果商品属性映射本身是错的,把模型换成便宜的五倍,只会让错误产出得更快更多。

真正的考验是核对:先在自己的一批真实数据上跑出成功率和单任务成本,再决定是否切换。到那时,答案才会真正浮出水面。

卖家应对与观察方向

六、参考资料

  • OpenAI 官方:《发布说明》(GPT-6.1 Sol 定价与开放范围)
  • OpenAI 官方:《推出 GPT-6.1 Sol》(模型定位与缓存价说明)
  • The Next Web:《OpenAI releases GPT-6.1 Sol at a fifth of GPT-6 Astra's token prices》
  • Unite.AI:《OpenAI Unveils GPT-6.1 Sol at DevDay With New Codex and ChatGPT Tools》
  • 凤凰网科技 / IT 之家:《OpenAI 宣布 ChatGPT 周活跃用户超 12 亿,AI 加速走向工作场景》