Claude Opus 5.5:最新功能、價格與替代方案 (2026)

Claude Opus 5.5 是 Anthropic 最新推出的通用模型,於 2026 年 9 月 22 日發布。它是 Claude 5.5 家族中的首款模型。API 定價為每百萬輸入 token $4 美元,以及每百萬輸出 token $20 美元。Anthropic 將其定位於長時間運行的程式碼編寫與知識工作,包括試算表、報告和簡報。
本指南涵蓋了已發布的內容,以及發布測試對實際完成工作的評價。此外,也介紹了獲取管道、成本以及值得比較的替代方案。所有數據均來自 Anthropic 截至 2026 年 9 月 23 日的官方網頁。
Anthropic 於 9 月 22 日發布的內容
Anthropic 於 2026 年 9 月 22 日(星期二)發表了這項公告。相同的日期也出現在 Claude Platform 的版本說明中,因此發布日期已得到兩個官方管道的證實。
宣傳主打非常簡短。Anthropic 表示,該模型「在大多數工作上的表現達到了 Claude Fable 5.1 的水準」。Fable 5.1 是該公司體量更大且更昂貴的模型,因此其賣點在於以更低的定位提供 Fable 級別的效果。
版本說明將 Opus 5.5 描述為「一款用於長時間運行代理程式碼編寫與知識工作的模型」。它們列出預設為 1M token 的上下文視窗,以及最大 128k 的輸出 token。自適應思考功能始終開啟。
開發人員的模型 ID 為 claude-opus-5-5。Anthropic 還指出,5.5 家族的其他成員將在未來幾週內陸續推出。
對實際完成工作至關重要的兩項發布測試
大多數發布文章都以程式碼編寫基準測試為開頭。但如果您的工作最終需要產出文件、簡報或報告,那麼本次發布中的兩項測試會更有用。
從 Excel 模型轉化為高階主管簡報
Anthropic 給了 Opus 5.5 和 Opus 5 相同的任務:分析兩家虛構人力資源軟體公司之間擬議的合併案。「兩者都在 Excel 中建立了財務模型,然後將其轉化為一份關於該交易價格是否合理的高階主管簡報。」
兩個模型對這筆交易得出了相同的結論。差別在於最終的輸出成果。Anthropic 報告指出,Opus 5.5 的模型「更為詳盡,且其簡報更易於閱讀」,而舊版模型的版本則有微小錯誤。
這是一個符合實際情況的工作型態。試算表是證據,而簡報則是高階主管實際閱讀的內容。一個能保持兩者一致的模型,可以省去通常用來找出不一致數字的審查步驟。
虛構數字未能通過測試的研究報告
第二項測試關乎準確性,而非修飾。Anthropic 要求三個模型撰寫一份關於公司季度業績的報告。這些模型只能使用一份難以找到收益發布資訊的網路副本。
「自動評分系統根據來源檢查了每個數據和引用內容。」Anthropic 表示:「在 Opus 5.5 的 18 份報告中,有 16 份通過了我們的品質標準,而任何虛構的數據或引用都會導致失敗。」它還補充道:「Fable 5.1 和 Opus 5 在任何一次嘗試中都未能通過該標準。」
對於任何需要發布數據的人來說,這是更為重要的結果。一份包含一個虛構數據的流暢報告,比一份沒有虛構數據但生成較慢的報告更糟糕,因為被引用的往往就是那個虛構的數據。
價格與方案
Anthropic 在其定價頁面上將 Opus 5.5 列為「用於代理程式碼編寫和企業工作的日常主力」。以下 API 費率是目前該頁面上顯示的價格。
| 項目 | Anthropic 顯示的價格 |
|---|---|
| Opus 5.5 輸入 | 每百萬 token $4 美元 |
| Opus 5.5 輸出 | 每百萬 token $20 美元 |
| 提示詞快取,讀取 | 每百萬 token $0.20 美元 |
| 提示詞快取,寫入(5 分鐘快取) | 每百萬 token $5 美元 |
| 快速模式 | 2 倍標準定價 |
| Claude 免費方案 | $0 美元 |
| Claude Pro 方案 | 每月 $20 美元(按月計費),或每年 $200 美元(按年計費) |
| Claude Max 方案 | 每月 $100 美元起 |
訂閱方案是大多數人接觸該模型的方式。Anthropic 表示,隨著此次發布,它正在提高 Pro、Max, Team 以及按席位計費的 Enterprise 方案的五小時使用限制。訂閱用戶還將獲得一個可以儲存並留待稍後使用的速率限制重設額度。
在規劃預算之前,有兩個成本細節值得了解。快取讀取是列表中每 token 費率最便宜的,Anthropic 表示它們佔了代理和程式碼編寫工作的大部分成本。快速模式以雙倍的標準費率換取速度,因此它比批次任務更適合互動式工作。
您可以在哪裡使用 Opus 5.5
版本說明列出了五種管道。它們分別是 Claude API、Amazon Bedrock 中的 Claude、AWS 上的 Claude Platform、Google Cloud 上的 Claude,以及 Microsoft Foundry 中的 Claude。公告補充說明,該模型已在所有平台上提供。
在 Claude 應用程式中,定價頁面將 Claude Design、Slides 和 Docs 列為付費方案的功能。這對本次發布非常重要,因為上述的簡報測試正是這些介面所針對的工作類型。我們之前關於 Claude Slides 的文章介紹了該輸出介面的運作方式。
Anthropic 的模型總覽提供了一個簡單的經驗法則。它建議開發人員「在大多數工作負載中先從 Claude Opus 5.5 開始」,並在評估結果仍未達預期時再使用 Fable 5.1。
行為表現有哪些改變
公告中有四個容易被忽略的行為改變。
思考功能始終開啟。版本說明指出,無法在此模型上停用思考功能。嘗試關閉該功能的請求將會傳回錯誤,因此較舊的整合可能需要進行微調。
寫作內容更具前置性。Anthropic 表示,該模型會「將最重要的資訊放在最前面」。早期測試人員發現其寫作內容比前一版本更清晰。對於報告和簡報文字來說,這就是「可直接使用的初稿」與「需要重新調整結構的草稿」之間的區別。
執行操作時更為謹慎。Anthropic 表示,與最近的模型相比,該模型執行難以逆轉之操作的可能性要低得多。它還報告了比 Opus 5 更強的防範提示詞注入能力。
合規性選項得以延續。Anthropic 表示,該模型與先前的 Opus 模型一樣,提供零數據保留選項。它還包含 Anthropic 用於遵守《歐盟人工智慧法案》的浮水印措施。受監管的團隊可以直接進行評估,而無需先修改其數據協議。
Anthropic 對於基準測試的態度也很坦率。它寫道:「基準測試的差距已不再是衡量現實世界差異的可靠指標。」這是一個有用的提醒,建議您在自己的檔案上進行測試,而不是盲目相信排行榜。
Opus 5.5 還是 Fable 5.1:該如何選擇
Fable 5.1 仍是 Anthropic 的頂級模型,定價為每百萬輸入 token $10 美元,以及每百萬輸出 token $50 美元。模型總覽推薦將其用於高要求的推理和長週期代理工作。
對於大多數報告和分析任務,發布證據表明應將 Opus 5.5 作為預設選擇。研究報告測試是最清晰的訊號,因為 Fable 5.1 在任何一次嘗試中都未能通過「無虛構數據」的標準。一個實用的分工如下:
- 將 Opus 5.5 用於定期報告、分析撰寫以及從試算表轉換為簡報的工作。
- 對於在新模型付出更高努力後,在您自己的測試中仍無法解決的問題,請使用 Fable 5.1。
- 對於成本最為關鍵的大批量任務,請使用 Sonnet 5(定價為每百萬 token 輸入 $2 美元,輸出 $10 美元)。
值得了解的替代方案
同一週還發布了另外兩款備受矚目的模型。這兩款模型都值得在您自己的工作負載中與新的 Opus 進行對比測試。
| 模型 | 發布日期 | 每百萬 token 的 API 價格 | 適用管道 |
|---|---|---|---|
| Claude Opus 5.5 | 2026 年 9 月 22 日 | 輸入 $4 / 輸出 $20 | Claude 應用程式、API 及各大雲端平台 |
| GPT-6 Sol | 2026 年 9 月 22 日 | 輸入 $2 / 輸出 $10 | ChatGPT Work、Codex、OpenAI API |
| GPT-6 Luna | 2026 年 9 月 22 日 | 輸入 $0.10 / 輸出 $0.50 | ChatGPT Work、Codex、OpenAI API |
| Grok 4.7 | 2026 年 9 月 21 日 | 輸入 $2 / 輸出 $6 | xAI API、Cursor、Grok Build |
GPT-6 Sol 與 GPT-6 Luna。OpenAI 在 Anthropic 發布的同一天推出了這兩款模型。OpenAI 表示,Plus、Pro、Business、Enterprise 和 Edu 用戶可以在 ChatGPT Work 和 Codex 中使用它們。Free 和 Go 用戶則可以在桌面版應用程式中使用 Luna。OpenAI 仍將 GPT-6 Astra 描述為其整體表現最佳的模型。
Grok 4.7。Grok 背後的公司 SpaceXAI 於 9 月 21 日發布了該模型。它將該模型描述為其「用於程式碼編寫和知識工作最強大的模型」。其服務價格與 Grok 4.6 相同。
最真實的選擇方法是進行一次小型對比測試。挑選一項實際任務(例如上一季度的報告),並使用相同的來源檔案在每個模型中運行。然後對照來源檢查每一個數據。
保持各模型之間的提示詞完全相同。記錄所花費的時間、每項任務的成本,以及您必須修正的每個數據。修正次數最少的模型通常就是勝出者,即使它不是每 token 價格最便宜的模型。
更好模型的極限之處
更強大的模型可以降低錯誤率,但並不能免除檢查工作的必要性。Anthropic 自身報告測試中使用了一個自動評分系統,該系統可以將每個數據追溯到其來源。讀者也需要同樣的追溯過程。
這就是工作區比模型名稱更重要的地方。Powerdrill Bloom 就是圍繞著與該評分系統相同的理念而構建的。其首頁將其描述為「會展示其工作過程的 AI 數據分析師」。它還補充道:「每一個數字都會附帶其背後的頁面、資料列和數據。」
Anthropic 合併測試中的工作流程也對應到一項常見的工作。您從試算表開始,最後產出簡報。我們的 Excel to PowerPoint 頁面為您自己的檔案提供了這條路徑。如果簡報需要一張主導投影片,我們的高階主管摘要投影片指南介紹了其應包含的內容。
透過測試來選擇模型,然後在輸出結果旁保留來源追溯路徑。這種結合才能確保報告可以安全發送。
如何開始使用 Opus 5.5
如果您使用 Claude 應用程式,請開啟一個新對話,並從模型選單中選擇 Opus 5.5。給它一個真實的檔案和一個真實的交付成果,而不是一個玩具般的提示詞。
如果您基於 API 進行開發,請將模型 ID 切換為 claude-opus-5-5,並移除任何停用思考功能的設定。然後在更改其他任何內容之前,重新運行您現有的評估集。比較每項任務的成本,而不僅僅是每 token 的成本,因為一個使用較少 token 的模型即使在費率相似的情況下,成本也可能更低。
If your output is a recurring report, keep a checklist of the figures that matter most. Check those first on every run, whichever model you choose.
當您希望在附帶來源的情況下處理從試算表到簡報的步驟時,您可以針對自己的檔案嘗試 Powerdrill Bloom。
常見問題
什麼是 Claude Opus 5.5?
Claude Opus 5.5 是 Anthropic 用於長時間運行程式碼編寫與知識工作的模型,於 2026 年 9 月 22 日發布。它是 Claude 5.5 家族中的首款模型。Anthropic 表示,它在大多數工作上的表現達到了 Fable 5.1 的水準。
Claude Opus 5.5 的費用是多少?
在 API 方面,Anthropic 列出的價格為每百萬輸入 token $4 美元,以及每百萬輸出 token $20 美元。快取讀取為每百萬 token $0.20 美元。在 Claude 應用程式中,可以透過訂閱方案獲取使用權限,其中 Pro 方案列出的價格為每月 $20 美元(按月計費)。
Opus 5.5 可以在 Claude 應用程式中使用嗎?
是的。Anthropic 表示該模型已在所有平台上提供,並在發布時提高了 Pro、Max、Team 以及按席位計費的 Enterprise 方案的使用限制。開發人員也可以在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上使用它。
Opus 5.5 與 Fable 5.1 有何不同?
Fable 5.1 是 Anthropic 體量更大的模型,定價為每百萬 token 輸入 $10 美元,輸出 $50 美元。Anthropic 建議在大多數工作負載中使用 Opus 5.5,並在最困難的推理任務中使用 Fable 5.1。在發布時的研究報告測試中,只有 Opus 5.5 通過了「無虛構數據」的標準。
可以關閉 Opus 5.5 的思考功能嗎?
不行。Claude Platform 的版本說明指出,無法在此模型上停用思考功能。嘗試關閉該功能的請求將會傳回錯誤,因此針對舊模型構建的整合可能需要更新。
來源: Anthropic,隆重推出 Claude Opus 5.5 · Claude Platform 版本說明 · Claude 模型總覽 · Claude 定價 · OpenAI,隆重推出 GPT-6 Sol 與 Luna · 隆重推出 Grok 4.7。價格與方案詳情取自 2026 年 9 月 23 日的廠商網頁。