超级促销周Claude Skills——20% 折扣
News

Claude Opus 5.5:新特性、定价与替代方案 (2026)

Powerdrill Bloom·
Claude Opus 5.5:新特性、定价与替代方案 (2026)

Claude Opus 5.5 是 Anthropic 最新的通用模型,于 2026 年 9 月 22 日发布。它是 Claude 5.5 家族中的首款模型。API 定价为每百万输入 token 4 美元,每百万输出 token 20 美元。Anthropic 将其定位为适用于长期运行的编码和知识工作,包括电子表格、报告和演示文稿。

本指南涵盖了已发布的内容以及发布测试对最终成果的评价。它还介绍了获取方式、成本以及值得对比的替代方案。所有数据均来自 Anthropic 截至 2026 年 9 月 23 日的官方页面。

Anthropic 在 9 月 22 日发布了什么

Anthropic 于 2026 年 9 月 22 日(星期二)发布了这一公告。相同的日期也出现在 Claude Platform 的发布说明中,因此发布日期已通过两个官方渠道得到确认。

核心宣传非常简短。Anthropic 表示,该模型“在大多数工作上的表现达到了 Claude Fable 5.1 的水平”。Fable 5.1 是该公司体量更大、价格更昂贵的模型,因此其卖点是以更低的档次提供 Fable 级别的效果。

发布说明将 Opus 5.5 描述为“一款用于长期运行的智能体编码和知识工作的模型”。它们列出了默认 1M token 的上下文窗口和最大 128k 的输出 token。自适应思考功能始终开启。

供开发人员使用的模型 ID 为 claude-opus-5-5。Anthropic 还指出,5.5 家族的其他成员将在未来几周内陆续推出。

对最终成果至关重要的两项发布测试

大多数发布公告都以编码基准测试开头。但如果您的工作最终需要交付文档、幻灯片或报告,那么本次发布中的两项测试会更有参考价值。

从 Excel 模型到高管演示文稿

Anthropic 给 Opus 5.5 和 Opus 5 安排了相同的任务:分析两家虚构的 HR 软件公司之间拟议的合并案。“每个模型都在 Excel 中构建了一个财务模型,然后将其转化为一份高管演示文稿,阐述该交易在当前价格下是否合理。”

两个模型对这笔交易得出了相同的结论。区别在于最终的输出。Anthropic 报告称,Opus 5.5 的模型“更彻底,其演示文稿更易于阅读”,而旧模型的版本则存在一些小错误。

这是一个非常贴近现实的任务形式。电子表格是证据,而演示文稿才是高管真正阅读的内容。一个能保持两者一致的模型可以省去通常用于捕捉数据不匹配的审核步骤。

虚构数据未能通过测试的研究报告

第二项测试关乎准确性,而非润色。Anthropic 要求三个模型撰写一份关于公司季度业绩的报告。这些模型只能使用一份很难找到财报发布信息的网页副本。

“一个自动评分器根据来源检查了每一个数据和引用。”Anthropic 表示,“在 Opus 5.5 的 18 份报告中,有 16 份通过了我们的质量标准,而任何虚构的数据或引用都会导致失败。”它还补充道,“Fable 5.1 和 Opus 5 在任何一次尝试中都未能通过该标准。”

对于任何发布数据的人来说,这都是更重要的结果。一份包含一个虚构数据的流畅报告,比一份没有虚构数据但生成较慢的报告更糟糕,因为被引用的往往正是那个虚构的数据。

价格与计划

Anthropic 在其定价页面上将 Opus 5.5 列为“适用于智能体编码和企业工作的日常主力”。下方的 API 费率是该页面目前显示的价格。

项目 Anthropic 显示的价格
Opus 5.5 输入 每百万 token 4 美元
Opus 5.5 输出 每百万 token 20 美元
提示词缓存,读取 每百万 token 0.20 美元
提示词缓存,写入(5分钟缓存) 每百万 token 5 美元
快速模式 2倍标准定价
Claude Free 计划 $0
Claude Pro 计划 每月 20 美元(按月计费),或每年 200 美元(按年计费)
Claude Max 计划 每月 100 美元起

订阅计划是大多数人接触该模型的方式。Anthropic 表示,在发布的同时,它正在提高 Pro、Max、Team 以及基于席位的 Enterprise 计划的五小时使用限制。订阅用户还将获得一个可以保存并稍后使用的速率限制重置额度。

在制定预算之前,有两个成本细节值得了解。缓存读取是列表中每 token 费率最便宜的,Anthropic 表示它们占了智能体和编码工作的大部分成本。快速模式以双倍的标准费率换取速度,因此它更适合交互式工作,而非批处理任务。

您可以在哪里使用 Opus 5.5

发布说明列出了五种途径。它们是 Claude API、Amazon Bedrock 中的 Claude、AWS 上的 Claude Platform、Google Cloud 上的 Claude 以及 Microsoft Foundry 中的 Claude。公告还补充道,它在所有平台上均可用。

在 Claude 应用程序内部,定价页面将 Claude Design、Slides 和 Docs 列为付费计划的功能。这对于本次发布非常重要,因为上述演示文稿测试正是这些界面所针对的工作类型。我们之前关于 Claude Slides 的文章介绍了该输出界面的工作原理。

Anthropic 的模型概述提供了一个简单的经验法则。它建议开发人员“在大多数工作负载中首先使用 Claude Opus 5.5”,并在评估结果仍不理想时再使用 Fable 5.1。

它的行为发生了哪些变化

公告中有四个行为变化很容易被忽略。

思考功能始终开启。发布说明指出,该模型无法禁用思考功能。尝试关闭该功能的请求将返回错误,因此较旧的集成可能需要进行微调。

写作更具前置性。Anthropic 表示,该模型“将最重要的信息放在最前面”。早期测试人员发现其写作比以前的版本更清晰。对于报告和幻灯片文本,这就是“可直接使用的初稿”与“需要重构的初稿”之间的区别。

在执行操作时更加谨慎。Anthropic 表示,与最近的模型相比,该模型采取难以逆转的操作的可能性要低得多。它还报告称,与 Opus 5 相比,其对提示词注入的抵抗力更强。

合规选项得以保留。Anthropic 表示,该模型与以前的 Opus 模型一样,支持零数据保留。它还包含 Anthropic 用于遵守《欧盟人工智能法案》(EU AI Act)的水印措施。受监管的团队可以在不先更改其数据协议的情况下对其进行评估。

Anthropic 对基准测试也持坦率态度。它写道,“基准测试的差距已不再是衡量现实世界差异的可靠指南。”这是一个有用的提醒,建议您在自己的文件上进行测试,而不是盲目相信排行榜。

Opus 5.5 还是 Fable 5.1:该选哪一个

Fable 5.1 仍是 Anthropic 的顶级模型,定价为每百万输入 token 10 美元,每百万输出 token 50 美元。模型概述推荐将其用于高要求的推理和长程智能体工作。

对于大多数报告和分析任务,发布证据表明应默认选择 Opus 5.5。研究报告测试是最清晰的信号,因为 Fable 5.1 在任何一次尝试中都未能通过“无虚构数据”的标准。一个实用的分工如下:

  • 将 Opus 5.5 用于定期报告、分析撰写以及从电子表格到演示文稿的工作。
  • 对于在新模型付出更高努力后仍无法通过您自身测试的问题,请使用 Fable 5.1。
  • 对于成本最重要的大批量任务,请使用 Sonnet 5(定价为每百万输入 token 2 美元,输出 token 10 美元)。

值得了解的替代方案

同一周还发布了另外两款备受瞩目的模型。这两款模型都值得在您自己的工作负载中与新的 Opus 进行对比测试。

模型 发布时间 每百万 token 的 API 价格 适用平台
Claude Opus 5.5 2026 年 9 月 22 日 $4 输入 / $20 输出 Claude 应用程序、API 及主流云平台
GPT-6 Sol 2026 年 9 月 22 日 $2 输入 / $10 输出 ChatGPT Work, Codex, OpenAI API
GPT-6 Luna 2026 年 9 月 22 日 $0.10 输入 / $0.50 输出 ChatGPT Work, Codex, OpenAI API
Grok 4.7 2026 年 9 月 21 日 $2 输入 / $6 输出 xAI API, Cursor, Grok Build

GPT-6 Sol 和 GPT-6 Luna。OpenAI 在 Anthropic 发布产品的同一天发布了这两款模型。OpenAI 表示,Plus、Pro、Business、Enterprise 和 Edu 用户可以在 ChatGPT Work 和 Codex 中使用它们。Free 和 Go 用户可以在桌面应用程序中使用 Luna。OpenAI 仍将 GPT-6 Astra 描述为其整体表现最好的模型。

Grok 4.7。Grok 背后的公司 SpaceXAI 于 9 月 21 日发布了该模型。它将该模型描述为其“用于编码 and 知识工作的最强大模型”。其服务价格与 Grok 4.6 相同。

最真诚的选择方法是进行一次小型对比测试。选择一个真实的任务,例如上一季度的报告,并在每个模型中运行相同的源文件。然后根据源文件检查每一个数据。

保持各模型之间的提示词完全相同。记录所花费的时间、每个任务的成本以及您必须纠正的每个数据。纠正次数最少的模型通常会胜出,即使它不是每 token 价格最便宜的。

更好的模型在何处不再起决定性作用

更强大的模型可以降低错误率。但它并不能免除检查工作的必要性。Anthropic 自身的研究报告测试使用了一个自动评分器,该评分器可以将每个数据追溯到其来源。读者也需要同样的追溯过程。

这就是工作区比模型名称更重要的地方。Powerdrill Bloom 就是围绕与该评分器相同的理念构建的。其主页将其描述为“展示其工作过程的 AI 数据分析师”。它还补充道:“每一个数据都会附带其背后的页面、行和具体数值。”

Anthropic 合并测试中的工作流也对应着一项常见的工作。您从电子表格开始,以演示文稿结束。我们的 Excel to PowerPoint 页面涵盖了针对您自己文件的这一路径。如果演示文稿需要一张引导幻灯片,我们的执行摘要幻灯片指南涵盖了其应该包含的内容。

通过测试来选择模型,然后在输出结果旁保留来源线索。这种结合才能让报告可以安全发送。

如何开始使用 Opus 5.5

如果您使用 Claude 应用程序,请开启新对话并从模型菜单中选择 Opus 5.5。给它一个真实的文件和一个真实的交付成果,而不是一个玩具式的提示词。

如果您基于 API 进行构建,请将模型 ID 切换为 claude-opus-5-5,并移除任何禁用思考功能的设置。然后在更改其他任何内容之前,重新运行您现有的评估集。对比每个任务的成本,而不仅仅是每 token 的成本,因为即使在费率相似的情况下,使用更少 token 的模型成本也可能更低。

如果您的输出是定期报告,请保留一份最重要数据的清单。无论您选择哪种模型,在每次运行时都先检查这些数据。

当您希望在处理“从电子表格到演示文稿”的步骤时附带来源,您可以针对自己的文件尝试 Powerdrill Bloom

常见问题解答

什么是 Claude Opus 5.5?

Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的用于长期运行的编码和知识工作的模型。它是 Claude 5.5 家族中的首款模型。Anthropic 表示,它在大多数工作上的表现达到了 Fable 5.1 的水平。

Claude Opus 5.5 的价格是多少?

在 API 上,Anthropic 列出的价格为每百万输入 token 4 美元,每百万输出 token 20 美元。缓存读取为每百万 token 0.20 美元。在 Claude 应用程序中,可以通过订阅计划进行访问,其中 Pro 计划列出的价格为每月 20 美元(按月计费)。

Opus 5.5 可以在 Claude 应用程序中使用吗?

是的。Anthropic 表示该模型在所有平台上均可用,并在发布时提高了 Pro、Max、Team 以及基于席位的 Enterprise 计划的使用限制。开发人员还可以在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上使用它。

Opus 5.5 与 Fable 5.1 有何不同?

Fable 5.1 是 Anthropic 体量更大的模型,价格为每百万输入 token 10 美元,输出 token 50 美元。Anthropic 推荐在大多数工作负载中使用 Opus 5.5,而在最难的推理任务中使用 Fable 5.1。在发布的研究报告测试中,只有 Opus 5.5 通过了“无虚构数据”的标准。

可以关闭 Opus 5.5 的思考功能吗?

不可以。Claude Platform 发布说明指出,该模型无法禁用思考功能。尝试关闭该功能的请求将返回错误,因此针对旧模型构建的集成可能需要更新。

来源: Anthropic,介绍 Claude Opus 5.5 · Claude Platform 发布说明 · Claude 模型概述 · Claude 定价 · OpenAI,介绍 GPT-6 Sol 和 Luna · 介绍 Grok 4.7。价格和计划详情于 2026 年 9 月 23 日读取自厂商页面。