OpenAI 在 2026 年 9 月 22 日发布 GPT‑6 Sol 和 GPT‑6 Luna。对经常用 AI 写代码、查资料或跑多步骤工作流的人,Sol 的变化很直观:API 标准价格从 GPT‑5.6 Sol 的每百万输入/输出 token 4/20 美元,降到 2/10 美元;OpenAI 同时报告了专业工作、代码和事实可靠性测试的进展。发布公告|API 更新日志
先把使用范围说清楚:**截至 9 月 23 日,GPT‑6 Sol 可用于符合条件的 ChatGPT Work、Codex 和 OpenAI API,尚未进入普通 Chat 对话。**如果你在日常聊天模型列表里找不到它,不代表账号出错。OpenAI 表示 Work 和 Codex 的开放会逐步完成。官方可用范围
这次更新,真正变了什么
GPT‑6 系列现在包括 Astra、Sol 和 Luna。Astra 面向最难的任务;Sol 更适合需要较强推理、又要反复运行的工作;Luna 面向更关注速度和成本的大批量任务。这是 OpenAI 的产品定位,不能据此断言某一个模型在你的所有任务上一定最好。官方模型目录
| 你关心的事 | GPT‑6 Sol 的已公布信息 | 实际含义 |
|---|---|---|
| 使用位置 | ChatGPT Work、Codex、API;暂不在普通 Chat 对话中 | 先在相应入口检查,不要拿普通聊天界面判断是否开放 |
| API 标准价 | 每百万输入 token 2 美元、输出 token 10 美元;缓存输入 0.20 美元 | 长期批量调用时值得重新核算单任务成本 |
| 上下文 | 最高 105 万 token;超过 27.2 万输入 token 有长上下文计价 | “能放进去”与“值得一次放进去”是两回事 |
| 输入输出 | 支持文本和图片输入,输出文本 | 不能把它当作直接生成音频或视频的模型 |

价格和规格以 GPT‑6 Sol 模型页为准。上表的标准价适用于不超过 27.2 万输入 token 的请求;长上下文、加速处理、区域处理和工具调用可能另计,不能用 2/10 美元概括所有账单。
一个简单的成本例子:假设一次任务消耗 10 万输入 token 和 2 万输出 token,不使用缓存或付费工具,GPT‑6 Sol 的标准 API 费用约为 0.40 美元;按发布前 GPT‑5.6 Sol 4/20 美元的促销价计算,同样用量约 0.80 美元。算法是“输入 token 数÷100 万×输入单价+输出 token 数÷100 万×输出单价”。这是按标价算出的示例,并非实测同一任务的真实花费。
如果同一个工作流反复发送相同的规则和资料,还要单独看缓存。GPT‑6 Sol 的缓存输入标价为每百万 token 0.20 美元:假设上述 10 万输入 token 中有 8 万实际命中缓存,剩下 2 万按普通输入计价,输出仍为 2 万,账面费用约为 0.256 美元。是否命中缓存由实际请求决定,不能把“重复提交过”直接当成“全部已缓存”。相反,若一次请求的输入超过 27.2 万 token,官方对整次长上下文请求采用更高费率;把几十篇文章一次性塞进去,未必比拆成可核对的任务便宜。计价说明
“更强”具体体现在哪里
OpenAI 公布的 AutomationBench 测试覆盖销售、营销、运营、客服等跨应用流程。在其公布的设置下,GPT‑6 Sol(xhigh)得分为 33.2%,每项任务成本为 0.27 美元;GPT‑6 Astra(low)得分为 30.3%,成本约为 Sol 的 3.9 倍。这个结果说明 Sol 值得进入多步骤工作的候选名单,不等于你的营销自动化也有 33.2% 的完成率:任务、工具、提示和评分方式都可能不同。测试说明与结果
事实可靠性也有一项值得注意的更新。OpenAI 称,在其基于用户曾报告错误的对话所做的内部测试中,GPT‑6 Sol 的错误约为上一代的一半。这个样本专门挑选过容易出错的场景,不能换算成普通使用中的“错误率减半”。对于新闻稿、产品参数、法律条款或报价,原始来源和人工核对仍是交付的一部分。测试口径
在代码工作上,OpenAI 报告 Sol 在 FrontierCode 和 DeepSWE 等测试中比 GPT‑5.6 Sol 有进步。DeepSWE 的公开结果中,Sol 在 max 档取得 68.8%,与同表另一款模型的最高设置相差 1.1 个百分点;这是特定代码任务和设置下的结果。更值得团队实测的是:它能否在你自己的代码库里按范围修改、通过测试、解释改动,并避免碰到无关文件。官方代码测试
这三组资料各回答一个不同问题:AutomationBench 看跨应用任务能否完成,内部事实测试看被挑出来的易错问答,代码基准看改动质量。它们都不能替你判断一篇中文 SEO 文章是否查全了来源、链接是否真实、改稿是否符合本站结构。这个判断要靠一组自己有答案的任务。
做 SEO 和网站运营的人,先拿什么任务试
不用先换掉所有流程。挑三个已经有旧结果、可以核对的任务,各跑一次 GPT‑5.6 Sol 和 GPT‑6 Sol。两次使用相同资料、工具权限、完成标准和人工审阅人;否则你比较到的可能是工作条件,而不是模型。
- **有来源的更新稿。**给模型同一份官方公告和产品文档,让它写一段中文“变化、适用对象、限制”。检查每个数字有没有出处,普通 Chat 与 Work 的开放范围是否混淆。
- **网站上的小改动。**让它修一个你已经知道验收方法的前端问题,例如移动端表格溢出。比较是否只改必要文件、是否提供可运行的验证结果。
- **跨步骤的内容工作。**给它一组已确认的关键词、现有页面和文章目录,让它提出更新顺序与内链建议。检查链接是否真实、页面主次是否清楚,以及它有没有把建议说成已经执行。
用一篇 AI 更新稿,完整跑一次对照
以本文题目为例,这是一套供你复用的试跑方案,不是本站对两款模型做出的实测结果。输入只给四样东西:OpenAI 的发布公告、GPT‑6 Sol 模型页、本站已有文章目录,以及读者是中文 SEO/建站从业者。任务要求模型交付一张事实清单、一份大纲和一段可发布的开头,而不是直接生成整篇稿件。
事实清单至少要写出四项:发布日期是 9 月 22 日;2/10 美元对应什么计价范围;Work、Codex、API 与普通 Chat 的开放差别;公开基准和本站实测的界限。每项旁边给源链接。如果模型写成“GPT‑6 Sol 已向所有 ChatGPT 聊天用户开放”,即使语句流畅也要判错;如果把 33.2% 写成“营销工作成功率”,同样判错。
大纲应让读者先找到“我能不能用”,再看到“价格怎么变、能力证据是什么”,最后判断“我该拿什么任务试”。开头可以这样写:**“GPT‑6 Sol 已进入 Codex、ChatGPT Work 和 API,普通 Chat 暂未开放。API 标准输入和输出单价比 GPT‑5.6 Sol 的促销价低一半;如果你每天重复做有来源的更新稿或网站修改,值得先拿三项已有验收结果的任务对照测试。”**这段是编辑示例,展示应该交付的答案形状,不冒充模型实际输出。
最后才交给模型扩写。审稿人沿事实清单逐句核对,并记录漏掉的来源、误写的范围和改稿时间。这样才能比较“哪一款更快交出可发布内容”;只看首稿字数和流畅度,很容易把后续人工返工漏掉。
网站修改与批量工作怎么选模型
再拿一个已知问题试代码能力:例如手机端的文章表格撑出屏幕。给两款模型同一份页面、样式文件和“390px、820px、1280px 均不出现整页横向滚动”的验收条件。合格交付应指出溢出元素、只改相关样式,并提供三档宽度的检查结果。只写“已优化响应式”却没有检查,不能算完成。这是测试设计示例,不表示本站已用 GPT‑6 Sol 修过这个页面。
若任务只是从大量文章中提取固定字段,可以把 Luna 一并纳入同样的对照;涉及多文件代码和资料判断、又需要反复运行的工作,先试 Sol;错误代价高、推理链条长的工作,再比较 Astra。这是依据官方模型定位安排试跑顺序,不是本站对三款模型的胜负结论。每项记录完成质量、人工返工时间、实际 token/工具费用和是否能交付,最后按每件合格成品的总成本决定是否迁移。
现在怎么用,哪些事别搞混
以下开放范围保留 2026 年 9 月 23 日的发布时信息。到今天选模型时,还应查账号当前入口与具体型号页;官方选择指南已包含更新的 GPT‑6.1 Sol,不能把新型号的说明直接套在本文的 GPT‑6 Sol 上。当前模型选择指南
在 ChatGPT Work 或 Codex 中,先检查当前账号是否出现 GPT‑6 Sol;官方列出的适用订阅包括 Plus、Pro、Business、Enterprise 和 Edu。Free、Go 用户目前可在桌面应用试用 GPT‑6 Luna。普通 Chat 对话尚未开放这两个新模型,官方说后续会逐步推出。开放说明
如果你用 API,模型 ID 是 gpt-6-sol。它支持 Responses API;Chat Completions 也可调用,但带函数调用时仅支持 reasoning_effort: "none"。原流程若依赖工具调用,先按官方迁移指引核对接口与推理档位,再在一小组旧任务上比较,不要只改模型名称就把生产任务切过去。
这次发布的重点,可以概括为:**Sol 让较强的模型更适合反复调用,但是否值得迁移,要由你的任务结果和总成本决定。**如果你只是等它出现在普通 Chat,下次打开前先看官方开放说明;如果你已经在 Codex、Work 或 API 做内容和网站工作,现在就可以用一组可核对的旧任务做对照。
把事实清单、稿件和页面验收接在一起,可沿SEO 内容生产流程检查每一步留下什么结果;模型请求成功还不等于文章可以发布。
常见问题
GPT‑6 Sol 已经能在普通 ChatGPT 聊天里选了吗?
截至 2026 年 9 月 23 日,OpenAI 的发布公告说还没有。它已开放到符合条件的 ChatGPT Work、Codex 和 API,且 Work、Codex 会逐步显示。
GPT‑6 Sol 比 GPT‑5.6 Sol 便宜多少?
按发布公告对比两者标准 API 单价,输入和输出每百万 token 均降低 50%。这不保证每项任务的总账单都减半,因为输出长度、缓存、长上下文、工具和处理档位会改变实际费用。
SEO 文章可以直接交给 GPT‑6 Sol 发布吗?
可以用它整理来源、起草或检查结构,但发布前仍要核对新闻日期、价格、开放范围、引文和站内链接。模型能力提升不等于每篇文章自动完成事实核验。