GPT-6 Sol and Luna:最新功能、定價與替代方案 (2026)

GPT-6 Sol 與 GPT-6 Luna 是 OpenAI 於 2026 年 9 月 22 日發布的兩款全新模型。它們可在 ChatGPT Work、Codex 以及 OpenAI API 中執行。API 的定價為:Sol 每百萬 token 輸入 $2、輸出 $10;Luna 則為輸入 $0.10、輸出 $0.50。
本指南將介紹發布的內容、各模型的適用範圍,以及發布測試對完成工作成效的評估。此外,我們也將探討定價與值得測試的替代方案。所有數據均源自 2026 年 9 月 24 日讀取的廠商官方網頁。
OpenAI 於 9 月 22 日發布的內容
OpenAI 於 2026 年 9 月 22 日星期二發表了此項公告。ChatGPT 的版本說明也標註了相同的日期,因此有兩個官方管道證實了這次的發布。
這兩款模型在同系列中定位低於 GPT-6 Astra。OpenAI 在 9 月初推出了 Astra,並稱其為「世界上最智慧且最符合人類意圖的模型」。這對新組合將該世代的技術帶入了速度更快、成本更低的模型中。
OpenAI 表示,Sol 與 Luna 的訓練採用了「與 GPT-6 Astra 類似的方法」。公告中列出了這些技術進步所延伸的五個領域:專業工作、真實性、程式編碼、電腦操作和對齊。
其定位明確指出了能力上限。OpenAI 寫道:「GPT-6 Astra 依然是我們全面表現最佳的模型。」GPT-6 Sol 是應對日常高要求工作的折衷選擇,而 Luna 則是處理高吞吐量任務的選擇。
對開發人員而言,模型 ID 為 gpt-6-sol 與 gpt-6-luna。對 ChatGPT 使用者而言,這些模型會出現在 Work 和 Codex 內部的模型選擇器中。
何處可以使用 Sol 與 Luna
其可用性規則比平時更為具體,因此值得仔細閱讀。
公告指出,這兩款模型已在 ChatGPT Work 和 Codex 中提供給「所有 Plus、Pro、Business、Enterprise 和 Edu 使用者」。Free 和 Go 使用者可以在桌面應用程式中使用 GPT-6 Luna。OpenAI 補充說明:「這些模型尚未在 Chat 中提供。」
版本說明以更通俗的字眼重申了這一點:「這些模型與 Chat 中可用的模型是分開的。」如果您開啟一般的對話,將無法在該處找到它們。
這種區分非常重要,因為 Work 和 Chat 負責不同的工作。OpenAI 的說明中心將 Work 描述為「專為更長、多步驟工作和最終交付成果而設計的代理」。它列出的工作包括研究、分析,或建立「文件、試算表、簡報、報告或網站」。
因此,GPT-6 Sol 主要是一款用於產出交付成果的模型,而非用於快速提問。我們之前關於什麼是 ChatGPT Work的說明文章,對該代理有更詳細的介紹。
說明中心提供了兩點實用注意事項。可用性取決於您的方案、工作區設定以及逐步推出的存取權限。同一篇文章指出,Plus 方案在 Work 和 Codex 中包含了 GPT-6 Astra,因此 Plus 使用者可以並排比較這三款模型。此外,OpenAI 表示,逐步推出將在發布當天陸續進行,因此某些帳戶看到這些模型的時間會比其他帳戶晚。
發布測試對完成工作成效的評估
大多數模型發布都會以程式編碼的分數為主打。如果您工作最終需要產出報告、試算表或簡報,這裡的三項測試會更有參考價值。
AutomationBench:跨應用程式的商業工作流程
OpenAI 將 AutomationBench 描述為「跨應用程式商業工作流程的測試」。在此測試中,代理會針對「在銷售、行銷、營運、支援、財務和人資領域中使用 47 種工具的端到端工作流程」進行測試。
OpenAI 報告指出,在此測試中,設定為極高思考程度的 GPT-6 Sol 表現優於設定為最大思考程度的 Claude Opus 5。報告還指出,Luna 在高思考程度下比其前代提高了 5.4 個百分點。
這是公告中最接近真實辦公室工作的測試。涉及 CRM、試算表和電子郵件工具的工作流程,正是許多週報實際產出的方式。
Agents' Last Exam:長流程專業任務
OpenAI 表示,Agents' Last Exam 涵蓋了「跨越 55 個子行業、具有經濟價值的長流程任務」。GPT-6 Sol 在最大思考程度下獲得了 56.4% 的分數。這項測試可作為一個粗略的指標,說明代理在需要人類協助之前,能獨自完成多長達數小時的任務。
OSWorld:操作電腦
在 OSWorld 2.0 離線測試中,極高思考程度下的 GPT-6 Sol 得分為 60.5%。OpenAI 表示,這與中等思考程度下的 Claude Opus 5 得分 60.3% 相似。OpenAI 仍將 Astra 描述為世界上最適合電腦操作的模型。
請將這三項結果視為廠商自行測試的數據。OpenAI 指出,其評估是在「我們的研究環境或透過我們的 API」進行的,這可能與實際線上的 ChatGPT 有所不同。
定價
下方的 API 價格為 OpenAI 在公告頁面上顯示的金額。價格以每百萬 token 計算。
| 模型 | 輸入 | 輸出 | 適用範圍 |
|---|---|---|---|
| GPT-6 Sol | $2 | $10 | ChatGPT Work、Codex、OpenAI API |
| GPT-6 Luna | $0.10 | $0.50 | ChatGPT Work、Codex、OpenAI API,以及 Free 和 Go 方案的桌面應用程式 |
| GPT-6 Astra | 未在此頁面列出 | 未在此頁面列出 | Plus 及更高階方案的 ChatGPT Work 和 Codex |
在 ChatGPT 內部,計費方式有所不同。說明中心指出,Work「遵循與 Codex 相同的計量結構」。您的方案包含一定的額度,而更繁重的任務會消耗更多額度。
使用 ChatGPT 帳戶登入 Codex 會使用您方案的使用量和帳單。而使用您自己的 API 金鑰則會採用 API 定價。同時使用這兩種方式的團隊,應在用量增長之前,先決定每個工作負載要走哪條路線。
真實性與寫作風格
對於任何需要發布數據的人來說,兩項較不引人注意的改變可能比基準測試分數更為重要。
更少的事實錯誤。在 OpenAI 的內部真實性測試中, GPT-6 Sol「犯下的錯誤大約只有其前代的一半」。該測試使用的是使用者曾標記錯誤的真實對話。OpenAI 補充了一個客觀的免責聲明:這些對話「並不代表典型的使用情況,在典型情況下,事實錯誤更為罕見」。
更簡短、更清晰的回答。OpenAI 表示,新模型延續了 Astra 的溝通風格。它承諾提供「更清晰、更少專業術語、更少古怪措辭、更少低價值細節,且在不失實質內容的前提下,整體回答稍微縮短」。
對於報告撰寫而言,第二項改變很容易被低估。一份能清晰陳述發現的草稿,在呈交給主管之前,需要修改的地方會少得多。
長流程代理執行的快取變更
除了模型之外,OpenAI 還改變了 GPT-6 系列的提示詞快取運作方式。公告指出,新系統預設能提供更高的快取命中率。
開發人員也獲得了更多控制權。明確的斷點讓他們可以選擇快取提示詞前綴的結束位置。現在,在不同請求之間變更推理思考程度和工具設定,不會破壞快取。
OpenAI 引用了一個早期成果。GitHub 報告指出,在數十億次請求中,這些改進「將需要重新處理的提示詞 token 比例降低了 50% 以上」。代理在每次輪次中都會重新發送相同的指令和工具定義,而這種重複的上下文正是快取旨在重複利用的內容。
Sol、Luna 或 Astra:該選擇哪一個
該系列現在涵蓋了三個價格與能力層級。簡單的劃分如下:
- 在 Work 中,使用 GPT-6 Sol 處理定期報告、分析撰寫以及試算表轉簡報的工作。
- 使用 Luna 處理高吞吐量的任務,例如分類、擷取和初步摘要。
- 當 Sol 在您自己的測試中表現不佳,或者任務時間長且至關重要時,請使用 Astra。
一個可靠的選擇方法是在您自己的檔案上進行測試。使用相同的輸入,讓 Sol 和 Luna 執行一項真實任務。記錄時間、每項任務的成本,以及您必須修正的每個數字。
值得了解的替代方案
同週還有另外兩款模型發布。這兩款都值得加入相同的測試中。
| 模型 | 發布日期 | 每百萬 token 的 API 價格 | 適用範圍 |
|---|---|---|---|
| GPT-6 Sol | 2026 年 9 月 22 日 | 輸入 $2 / 輸出 $10 | ChatGPT Work、Codex、OpenAI API |
| GPT-6 Luna | 2026 年 9 月 22 日 | 輸入 $0.10 / 輸出 $0.50 | ChatGPT Work、Codex、OpenAI API |
| Claude Opus 5.5 | 2026 年 9 月 22 日 | 輸入 $4 / 輸出 $20 | Claude API |
| Grok 4.7 | 2026 年 9 月 21 日 | 輸入 $2 / 輸出 $6(低於 200k 提示詞 token) | xAI API、Cursor、Grok Build |
Claude Opus 5.5。Anthropic 在同一天發布了這款模型。其定價頁面將該模型描述為「代理程式編碼和企業工作的日常主力」。付費的 Claude 方案也將 Claude Design、Slides 和 Docs 列為功能,這非常適合簡報和文件工作。
Grok 4.7。SpaceXAI 的版本說明指出,它已在 xAI API 上提供,名稱為 grok-4.7。定價為低於 200k 提示詞 token 時輸入 $2、輸出 $6,高於此額度時則為 $4 與 $12。更快速的變體版本僅能透過 Cursor 和 Grok Build 使用。
如果您的工作主要是程式編碼,這三款模型的基準測試頁面是很好的起點。如果主要是報告和簡報,用上個季度的檔案進行實際對決會告訴您更多資訊。
便宜模型不再有幫助的臨界點
更低的每 token 價格讓執行更多任務變得更容易。但這並不能免除檢查輸出的必要性。一份包含一個錯誤數據的報告仍然是一份錯誤的報告,無論其製作成本有多低。
在進行這項檢查時,工作區的重要性更甚於模型名稱。Powerdrill Bloom 將自己描述為「展示其工作過程的 AI 數據分析師」。其首頁補充道:「每個數字都會附帶其背後的頁面、列和數據。」
這種工作型態與 GPT-6 Sol 在 Work 中鎖定的目標相同。您從試算表或一組文件開始,最後得到一個完成的檔案。我們的 Excel to PowerPoint 頁面介紹了適用於您自己檔案的該路徑。如需了解該系列頂級模型的背景資訊,請參閱我們的 GPT-6 Astra 介紹文章。
透過測試來選擇模型。然後將來源追蹤路徑保留在輸出旁,以便審查人員能在幾秒鐘內確認每個數字。
如何開始使用 GPT-6 Sol 與 Luna
如果您使用 ChatGPT,請開啟 Work 而非一般的聊天。從選擇器中選擇模型,然後給它一個真實的檔案和一個真實的交付成果。一份季度摘要或每週指標簡報,會是比玩具提示詞更好的測試。
如果您是在 API 上進行開發,請將模型 ID 切換為 gpt-6-sol 或 gpt-6-luna,並先重新執行您的評估集。比較每項任務的成本,而不僅僅是每 token 的成本。一個能以更少步驟完成任務的模型,整體的成本可能會更低。
如果您的輸出是定期報告,請保留一份最重要數據的簡短清單。無論是由哪款模型產出的,在每次執行時都先檢查這些數據。
當您想將試算表轉換為附帶來源的圖表、報告或簡報時,您可以針對自己的檔案嘗試使用 Powerdrill Bloom。
常見問題
什麼是 GPT-6 Sol 與 GPT-6 Luna?
它們是 OpenAI 於 2026 年 9 月 22 日發布的模型,在同系列中定位低於 GPT-6 Astra。GPT-6 Sol 針對高要求的日常工作,而 Luna 則針對高吞吐量的任務。兩者均可在 ChatGPT Work、Codex 和 OpenAI API 中執行。
GPT-6 Sol 的費用是多少?
在 API 方面,OpenAI 將 GPT-6 Sol 的定價列為每百萬輸入 token $2,每百萬輸出 token $10。Luna 則為輸入 $0.10、輸出 $0.50。在 ChatGPT 內部,可透過您方案的 Work 和 Codex 額度進行存取。
GPT-6 Sol 可以在一般的 ChatGPT 聊天中使用嗎?
不行。版本說明指出,Sol 與 Luna「與 Chat 中可用的模型是分開的」。您可以在 Work 和 Codex 中找到它們。Free 和 Go 使用者可以在 ChatGPT 桌面應用程式中使用 Luna。
GPT-6 Sol 與 GPT-6 Astra 有何不同?
Astra 是 OpenAI 的頂級模型,被其稱為「全面表現最佳的模型」。Sol 採用了類似的方法進行訓練,旨在提供速度更快、成本更低的工作。OpenAI 建議將 Astra 用於最苛刻且最重要的專案。
為什麼要使用 GPT-6 Luna 而非 Sol?
Luna 的每 token 成本較低,適合高吞吐量、較簡單的任務,例如擷取和初步摘要。OpenAI 報告指出,在較高思考程度下,Luna 在其真實性測試中的表現與 GPT-5.6 Sol 相當。Sol 則更適合複雜、多步驟的交付成果。
來源: OpenAI, Introducing GPT-6 Sol and Luna · ChatGPT release notes · ChatGPT Work and Codex help article · Claude pricing · xAI API release notes。價格與可用性資訊源自 2026 年 9 月 24 日讀取的廠商官方網頁。