超级促销周Claude Skills——20% 折扣
News

GPT-6 Sol 和 Luna:新功能、定价与替代方案 (2026)

Powerdrill Bloom·
GPT-6 Sol 和 Luna:新功能、定价与替代方案 (2026)

GPT-6 Sol 和 GPT-6 Luna 是 OpenAI 于 2026 年 9 月 22 日发布的两款新模型。它们运行在 ChatGPT Work 和 Codex 以及 OpenAI API 中。API 定价为:Sol 每百万 token 输入 $2、输出 $10;Luna 每百万 token 输入 $0.10、输出 $0.50。

本指南涵盖了发布的产品、各模型的可用范围,以及发布测试对最终工作成果的评估。它还介绍了定价以及值得测试的替代方案。所有数据均来自 2026 年 9 月 24 日查阅的厂商页面。

OpenAI 在 9 月 22 日发布了什么

OpenAI 于 2026 年 9 月 22 日(星期二)发布了这一公告。ChatGPT 的发布说明也标注了相同的日期,因此两个官方渠道均确认了此次发布。

这两款模型在同系列中定位低于 GPT-6 Astra。OpenAI 在 9 月早些时候推出了 Astra,并称其为“世界上最智能、最对齐的模型”。这一新组合将该代模型带入了速度更快、成本更低的阶段。

OpenAI 表示,它“采用与 GPT-6 Astra 类似的方法”训练了 Sol 和 Luna。公告列出了这些技术进步所延伸到的五个领域:专业工作、真实性、编程、电脑使用和对齐。

其定位明确了能力上限。OpenAI 写道:“GPT-6 Astra 仍然是我们全面表现最好的模型。”GPT-6 Sol 是应对日常高要求工作的中间选择,而 Luna 则是高吞吐量任务的选择。

对于开发者,模型 ID 分别为 gpt-6-sol 和 gpt-6-luna。对于 ChatGPT 用户,这些模型会出现在 Work 和 Codex 内部的模型选择器中。

在哪里可以使用 Sol 和 Luna

其可用性规则比平时更为具体,因此值得仔细阅读。

公告称,这两款模型已在 ChatGPT Work 和 Codex 中向“所有 Plus、Pro、Business、Enterprise 和 Edu 用户”开放。Free 和 Go 用户可以在桌面端应用中使用 GPT-6 Luna。OpenAI 补充道:“这些模型尚未在 Chat 中提供。”

发布说明用更通俗的话重复了这一点:“这些模型与 Chat 中可用的模型是分开的。”如果您开启普通对话,将无法在其中找到它们。

这种划分非常重要,因为 Work 和 Chat 承担着不同的工作。OpenAI 的帮助中心将 Work 描述为“专为更长、多步骤工作和最终交付成果而设计的智能体”。它列出的工作包括研究、分析,或创建“文档、电子表格、演示文稿、报告或站点”。

因此,GPT-6 Sol 主要是一款用于生成交付成果的模型,而不是用于快速提问。我们之前关于什么是 ChatGPT Work的解释文章更详细地介绍了该智能体。

帮助中心提到了两点实用注意事项。可用性取决于您的方案、工作区设置和灰度发布权限。同一篇文章指出,Plus 方案在 Work 和 Codex 中包含 GPT-6 Astra,因此 Plus 用户可以并排对比所有这三款模型。此外,OpenAI 表示,灰度发布将在发布日当天逐步进行,因此某些账户看到这些模型的时间会比其他账户晚。

发布测试对最终工作成果的评估

大多数模型发布都会以编程评分作为主打。如果您工作最终需要交付报告、电子表格或幻灯片,那么这里的其中三项测试会更有参考价值。

AutomationBench:跨应用的业务工作流

OpenAI 将 AutomationBench 描述为“对跨应用业务工作流的测试”。在测试中,智能体需要接受“使用销售、营销、运营、支持、财务和人力资源领域的 47 个工具进行端到端工作流”的测试。

OpenAI 报告称,在此项测试中,处于 xhigh 思考程度的 GPT-6 Sol 表现优于处于 max 思考程度的 Claude Opus 5。报告还指出,Luna 在 high 思考程度下比其前代产品提高了 5.4 个百分点。

这是公告中最接近真实办公室工作的测试。涉及 CRM、电子表格和电子邮件工具的工作流,正是许多周报实际制作的方式。

Agents' Last Exam:长周期专业任务

OpenAI 表示,Agents' Last Exam 涵盖了“跨越 55 个子行业的长周期、具有经济价值的任务”。GPT-6 Sol 在 max 思考程度下的得分为 56.4%。该测试可作为一个粗略的信号,表明智能体在需要人工帮助之前,能在长达数小时的任务中推进到什么程度。

OSWorld:操作电脑

在 OSWorld 2.0 离线测试中,处于 xhigh 思考程度的 GPT-6 Sol 得分为 60.5%。OpenAI 表示,这与处于 medium 思考程度的 Claude Opus 5(得分为 60.3%)相似。OpenAI 仍然将 Astra 描述为世界上最适合电脑使用的模型。

请将这三项结果均视为厂商运行的测试。OpenAI 指出,其评估是在“我们的研究环境或通过我们的 API”运行的,这可能与生产环境中的 ChatGPT 有所不同。

定价

以下 API 价格是 OpenAI 在公告页面上显示的价格。价格按每百万 token 计算。

模型 输入 输出 使用场景
GPT-6 Sol $2 $10 ChatGPT Work、Codex、OpenAI API
GPT-6 Luna $0.10 $0.50 ChatGPT Work、Codex、OpenAI API,以及 Free 和 Go 方案的桌面端应用
GPT-6 Astra 此页面未列出 此页面未列出 Plus 及更高方案的 ChatGPT Work 和 Codex

在 ChatGPT 内部,费用的计算方式有所不同。帮助中心表示,Work“遵循与 Codex 相同的使用结构”。您的方案中包含一定的额度,更繁重的任务会消耗更多额度。

使用 ChatGPT 账户登录 Codex 会消耗您方案的使用额度并按其计费。而使用您自己的 API 密钥则会采用 API 定价。同时使用这两种方式的团队应该在用量增长之前,决定每个工作负载采用哪种路径。

真实性与写作风格

对于任何发布数据的人来说,两项较为低调的改进可能比基准测试得分更为重要。

更少的错误事实。在 OpenAI 的内部真实性测试中,GPT-6 Sol“犯的错误大约是其前代产品的一半”。该测试使用的是用户标记过错误的真实对话。OpenAI 补充了一个合理的免责声明:这些对话“并不代表典型用法,在典型用法中,事实错误更为罕见”。

更简短、更清晰的回答。OpenAI 表示,新模型延续了 Astra 的沟通风格。它承诺“在不流失实质内容的前提下,整体上提供更清晰、更少行话、更少古怪措辞、更少低价值细节以及略微更简短的回答”。

对于报告撰写而言,第二项改变很容易被低估。一份清晰陈述其发现的草稿在提交给经理之前,需要进行的修改更少。

针对长周期智能体运行的缓存改进

伴随这些模型,OpenAI 还改变了 GPT-6 系列的提示词缓存工作方式。公告称,新系统默认提供更高的缓存命中率。

开发者也获得了更多控制权。显式断点允许他们选择缓存提示词前缀的结束位置。推理思考程度和工具设置现在可以在请求之间更改,而不会破坏缓存。

OpenAI 引用了一个早期结果。GitHub 报告称,在数十亿次请求中,这些改进“将需要重新处理的提示词 token 比例降低了 50% 以上”。智能体在每轮对话中都会重新发送相同的指令和工具定义,而这种重复的上下文正是缓存旨在复用的内容。

Sol、Luna 还是 Astra:该选哪一个

该系列现在涵盖了三个价格 and 能力层级。简单的划分如下:

  • 在 Work 内部,使用 GPT-6 Sol 处理定期报告、分析撰写以及电子表格转幻灯片的工作。
  • 使用 Luna 处理高吞吐量任务,例如分类、提取和初步摘要。
  • 当 Sol 在您自己的测试中表现不佳,或者任务周期长且至关重要时,请使用 Astra。

一种可靠的选择方法是在您自己的文件上进行测试。使用相同的输入,在 Sol 和 Luna 上运行一个真实的任务。记录时间、每个任务的成本以及您必须纠正的每个数字。

值得了解的替代方案

同一周内还有另外两款模型发布。这两款模型都值得加入到相同的测试中。

模型 发布时间 每百万 token 的 API 价格 使用场景
GPT-6 Sol 2026 年 9 月 22 日 $2 输入 / $10 输出 ChatGPT Work、Codex、OpenAI API
GPT-6 Luna 2026 年 9 月 22 日 $0.10 输入 / $0.50 输出 ChatGPT Work、Codex、OpenAI API
Claude Opus 5.5 2026 年 9 月 22 日 $4 输入 / $20 输出 Claude API
Grok 4.7 2026 年 9 月 21 日 $2 输入 / $6 输出(200k 提示词 token 以下) xAI API、Cursor、Grok Build

Claude Opus 5.5。Anthropic 在同一天发布了它。其定价页面将该模型描述为“用于智能体编程和企业工作的日常主力”。付费的 Claude 方案还将 Claude Design、Slides 和 Docs 列为功能,这非常适合幻灯片和文档工作。

Grok 4.7。SpaceXAI 的发布说明称,它已在 xAI API 上提供,模型 ID 为 grok-4.7。在 200k 提示词 token 以下,定价为输入 $2、输出 $6;在 200k 以上,定价为输入 $4、输出 $12。更快的变体仅通过 Cursor 和 Grok Build 提供。

如果您的工作主要是编程,那么这三款模型的基准测试页面是开始了解的好地方。如果主要是报告和幻灯片,那么在上季度文件上进行一次实测对比会告诉您更多信息。

便宜模型不再起作用的边界

更低的每 token 价格使得运行更多任务变得更容易。但这并不能免除检查输出的必要性。一份包含一个错误数字的报告仍然是一份错误的报告,无论制作它的成本有多低。

这种检查正是工作区比模型名称更重要的地方。Powerdrill Bloom 将自己描述为“展示其工作过程的 AI 数据分析师”。其主页补充道:“每一个数字都附带其背后的页面、行和数据。”

这种工作形式正是 GPT-6 Sol 在 Work 中所针对的。您从一个电子表格或一组文档开始,最后得到一个完成的文件。我们的 Excel to PowerPoint 页面涵盖了针对您自己文件的这一路径。有关该系列中顶级模型的背景信息,请参阅我们的 GPT-6 Astra 介绍文章。

通过测试来选择模型。然后将来源追踪保留在输出结果旁,以便审查人员可以在几秒钟内确认每个数字。

如何开始使用 GPT-6 Sol 和 Luna

如果您使用 ChatGPT,请打开 Work 而不是普通对话。从选择器中选择模型,然后给它一个真实的文件和一个真实的交付目标。季度总结或每周指标幻灯片比玩具提示词能进行更好的测试。

如果您基于 API 进行构建,请先将模型 ID 切换为 gpt-6-sol 或 gpt-6-luna 并重新运行您的评估集。对比每个任务的成本,而不仅仅是每个 token 的成本。一个用更少步骤完成任务的模型,其总体成本可能会更低。

如果您的输出是定期报告,请保留一份最重要数字的简短清单。无论是由哪款模型生成的,在每次运行中都要首先检查这些数字。

当您希望将电子表格转换为带有来源的图表、报告或幻灯片时,您可以在自己的文件上尝试 Powerdrill Bloom。

常见问题解答

什么是 GPT-6 Sol 和 GPT-6 Luna?

它们是 OpenAI 于 2026 年 9 月 22 日发布的模型,在同系列中定位低于 GPT-6 Astra。GPT-6 Sol 针对高要求的日常工作,而 Luna 针对高吞吐量的任务。两者均运行在 ChatGPT Work、Codex 和 OpenAI API 中。

GPT-6 Sol 的价格是多少?

在 API 上,OpenAI 将 GPT-6 Sol 的定价列为每百万输入 token $2,每百万输出 token $10。Luna 为输入 $0.10,输出 $0.50。在 ChatGPT 内部,可以通过您方案的 Work 和 Codex 额度进行访问。

GPT-6 Sol 可以在普通 ChatGPT 对话中使用吗?

不能。发布说明指出,Sol 和 Luna“与 Chat 中可用的模型是分开的”。您可以在 Work 和 Codex 中找到它们。Free 和 Go 用户可以在 ChatGPT 桌面端应用中使用 Luna。

GPT-6 Sol 和 GPT-6 Astra 有什么区别?

Astra 是 OpenAI 的顶级模型,被其称为“全面表现最好的模型”。Sol 采用类似的方法进行训练,旨在提供速度更快、成本更低的工作体验。OpenAI 建议在最苛刻和最重要的项目中使用 Astra。

为什么选择 GPT-6 Luna 而不是 Sol?

Luna 的每 token 成本更低,适合高吞吐量、更简单的任务,例如提取和初步摘要。OpenAI 报告称,在更高的思考程度下,Luna 在其真实性测试中的表现与 GPT-5.6 Sol 相当。Sol 更适合复杂的、多步骤的交付成果。

来源: OpenAI, Introducing GPT-6 Sol and Luna · ChatGPT release notes · ChatGPT Work and Codex help article · Claude pricing · xAI API release notes。价格和可用性信息于 2026 年 9 月 24 日查阅自厂商页面。