超级促销周Claude Skills——20% 折扣
News

Claude Sonnet 5.5 和 Haiku 5.5:新功能、价格及替代方案 (2026)

Powerdrill Bloom·
Claude Sonnet 5.5 和 Haiku 5.5:新功能、价格及替代方案 (2026)

Claude Sonnet 5.5 和 Claude Haiku 5.5 是 Anthropic 的 Claude 5.5 家族中两款最新的模型。Sonnet 模型于 2026 年 9 月 28 日发布,Haiku 5.5 紧随其后于 2026 年 10 月 7 日发布。Sonnet 5.5 的 API 价格为每百万 token 输入 $2、输出 $10。Haiku 5.5 的起步价为输入 $0.10、输出 $0.50。

本指南涵盖了每款模型的变化,以及发布测试中关于文档、幻灯片和电子表格的表现。它还介绍了价格、限制以及值得测试的替代方案。所有数据均来自 2026 年 10 月 8 日查阅的厂商页面。

Anthropic 发布了什么,以及何时发布

三个官方渠道确认了这些日期。Anthropic 的模型页面显示 Sonnet 于 9 月 28 日发布,Haiku 于 10 月 7 日发布。Claude Platform 的发布说明也包含这两个相同的日期。用于追踪 Claude 应用程序的 Claude Help Center 发布说明同样列出了这两次发布。

该家族目前拥有三名成员。Claude Opus 5.5 最先于 9 月 22 日推出。Anthropic 将新版 Sonnet 称为“Claude 5.5 家族中的第二款模型”。它将该模型描述为“Claude Opus 5.5 的速度更快、成本更低的补充”。

Haiku 5.5 让这一组合更加完整。Anthropic 将其介绍为“我们发布过的最便宜、最快且最强大的小型模型”。这是厂商自己的说法,因此可以将其作为您测试的起点。

对于开发者,模型 ID 为 claude-sonnet-5-5 和 claude-haiku-5-5。根据平台发布说明,这两款模型均可在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上使用。

Claude Sonnet 5.5:有哪些变化

Anthropic 将 Sonnet 5.5 定位为该家族中的日常模型。其发布页面称,该模型“在范围明确的日常任务、修复 Bug 以及创建精美的文档、幻灯片和电子表格方面表现最强”。该页面还补充道:“它对设计也有着敏锐的眼光。”

发布页面上有四个变化尤为突出:

  • 速度。 Anthropic 表示 Sonnet 5.5 “生成输出的速度比 Sonnet 5 快 30%+”。它称其为迄今为止最快的 Sonnet 模型。
  • 写作。 据 Anthropic 称,与 Opus 5.5 一样,新版 Sonnet “比我们上一代模型的写作更清晰”。
  • 长任务与图像。 Anthropic 表示,它是“第一款仅凭屏幕截图就通关《宝可梦红》(Pokémon Red)的 Sonnet 模型”。
  • 安全。 它是第一款在发布时就配备了网络安全防护措施的 Sonnet 模型,类似于 Anthropic 最强大模型上的防护措施。

Anthropic 也明确了其上限。页面指出,“在需要持续判断的复杂、开放式工作中,Opus 5.5 依然明显更强”。在实际应用中,Sonnet 模型可以处理大部分日常工作,而 Opus 5.5 则用于应对棘手的难题。

在您切换之前,有一条开发者注意事项非常重要。在转向 Sonnet 5.5 之前,关闭思考功能运行 Sonnet 的团队需要启用新的 between_tools 设置。Anthropic 的迁移指南涵盖了相关细节。

Claude Haiku 5.5:有哪些变化

Haiku 5.5 针对的是高吞吐量任务。Anthropic 表示,它“专为高吞吐量、成本敏感型任务而设计”。发布页面将“摘要、压缩、数据库查询和分类请求”列为典型工作。

该页面还将 Haiku 5.5 描述为大型模型的助手。它“非常适合与 Opus 5.5 和 Sonnet 5.5 搭配,在编程工作中充当子智能体(subagent)”。脚注补充道,Haiku 5.5 是 Anthropic 在标准速度下最快的模型。

Haiku 5.5 也是“我们第一款配备可调节努力程度(effort)设置的 Haiku 级别模型”。这让您可以在每次请求中权衡成本与质量,就像您在更大的模型上已经可以做到的那样。

发布页面上的两则客户评价直接描述了报告和幻灯片演示文稿(deck)的工作。Box 表示,它将在“大规模运行的分析工作中使用 Haiku 5.5,从成本报告到财务摘要以及每周定期审查”。Rogo 在其评价中描述了一项分工任务:“当更大的模型构建幻灯片时,Haiku 5.5 子智能体可以深入 10-K 报告并提取幻灯片所需的细分收入数据。”

第二种模式非常值得借鉴。大模型负责规划和写作,小模型负责获取所需的数据。

发布测试中关于文档、幻灯片和电子表格的表现

两个发布页面都包含了编程基准测试。如果您最终的工作成果是报告、电子表格或幻灯片,那么这些页面上的其中三项测试会更有参考价值。

GDPval-AA 和 AA-Briefcase:专业工作

Anthropic 将 GDPval-AA v2.1 描述为一项“评估智能体在 44 个职业中实际专业工作表现”的测试。新版 Sonnet 在该测试中得分为 1844 分,比 Opus 5.5 的 1846 分低两分。Haiku 5.5 得分为 1620 分。

在长周期知识工作测试 AA-Briefcase v1.1 中,Sonnet 模型得分为 1811 分,Haiku 5.5 得分为 1578 分。这两项测试均由 Artificial Analysis 运行,Anthropic 指出存在一个发布前的 Bug,可能略微低估了 Sonnet 5.5 的得分。

Chartography:读取图表

Chartography 衡量的是视觉图表识别能力。在不使用任何工具的情况下,新版 Sonnet 得分为 61.6%,Haiku 5.5 得分为 46.4%。在同一张表格中,Sonnet 5 的得分为 15.6%。

如果您的输入内容包括图表截图、扫描报告或他人幻灯片中的页面,那么这项测试非常值得关注。

OSWorld:操作电脑

在 OSWorld 2.1 中,Sonnet 模型在部分得分(partial credit)上得分为 80.1%。Haiku 5.5 在离线子集上得分为 72.4%。这两个数字使用了不同的评分标准,因此请仅将各模型与 Anthropic 在其旁列出的行进行对比。

请将所有这些结果视为厂商公布的数据。您自己的文件以及您特有的格式习惯,才是真正具有决定意义的测试。

价格

下方的 API 价格为 Claude 价格页面上显示的内容。价格以每百万 token 计算,提示词缓存(prompt caching)价格反映的是 5 分钟的缓存。

模型 输入 输出 缓存读取 缓存写入
Claude Sonnet 5.5 $2 $10 $0.10 $2.50
Claude Haiku 5.5,提示词不超过 100K token $0.10 $0.50 $0.01 $0.125
Claude Haiku 5.5,提示词超过 100K token $0.50 $2.50 $0.05 $0.625
Claude Opus 5.5 $4 $20 $0.20 $5

Haiku 5.5 是表中唯一拥有两个价格档位的模型。档位取决于提示词长度,因此长提示词的单 token 成本更高。Anthropic 表示,不超过 100,000 个 token 的提示词“约占我们之前 Haiku 模型请求量的 90%”。

在 Claude 应用程序内部,费用是通过订阅方案而非 token 来计算的。价格页面列出,年付方案中 Pro 的价格为每月 $17,按月计费则为每月 $20。Max 的起步价为每月 $100。

Max 和 Team 订阅用户还将获得用于 Claude Platform 的全新每月 API 额度。Haiku 5.5 页面列出,Max 5x 每月为 $100,Max 20x 每月为 $200,Team 每月最高可达 $500(由用户共享)。

上下文窗口、输出限制和努力程度设置

Anthropic 的模型概览列出了两款模型的相同核心限制:

  • 上下文窗口: 1M token。
  • 最大输出: 128K token。
  • 输入: 文本和图像,输出为文本。

对于 Haiku 用户来说,努力程度(effort)设置是更大的实际变化。发布页面绘制了 Haiku 5.5 在五个努力程度级别(从 Low 到 Max)下与每项任务成本的对比图表。Anthropic 的 Sonnet 5.5 页面解释了这一普遍规律:更高的努力程度通常意味着每项任务的成本更高,得分也更高。

对于定期报告,这提供了一个简单的规则。从较低的努力程度设置开始,将输出结果与已知合格的报告进行对比,仅在低设置无法满足要求时才提高努力程度。

Sonnet 5.5、Haiku 5.5 还是 Opus 5.5:该如何选择

Anthropic 官方的描述给出了明确的分工:

  • 使用 Opus 5.5 处理需要持续判断的长篇、高风险工作。
  • 使用 Sonnet 5.5 处理日常文档、幻灯片和电子表格,以及大多数智能体(agent)任务。
  • 使用 Haiku 5.5 处理高吞吐量的步骤,例如提取、分类、摘要和子智能体(subagent)查询。

模型概览用一句话分别概括了它们。Sonnet 5.5 是“速度与智能的最佳结合”。Haiku 5.5 则“适用于高吞吐量、对延迟敏感的任务,例如分类、提取和路由”。

一种可靠的选择方法是在您自己的文件上进行测试。使用相同的输入,让两款模型运行同一个真实任务。记录时间、每项任务的成本以及您必须纠正的每一个数字。

值得了解的替代方案

在相同的两周内,还有其他几款前沿模型发布。下表列出了您今天可以尝试的模型,以及一款已公布但尚未开放的模型。

模型 发布时间 每百万 token 的 API 价格 何处使用
Claude Sonnet 5.5 2026 年 9 月 28 日 输入 $2 / 输出 $10 Claude 应用程序、Claude API、云平台
Claude Haiku 5.5 2026 年 10 月 7 日 输入 $0.10 起 / 输出 $0.50 起 Claude API、云平台
GPT-6.1 Sol 2026 年 9 月 29 日 输入 $2 / 输出 $10,最高支持 272K 输入 token ChatGPT Work、Codex、OpenAI API
GPT-6 Luna 2026 年 9 月 22 日 输入 $0.10 / 输出 $0.50,最高支持 272K 输入 token ChatGPT、OpenAI API
Gemini 4 Argon 2026 年 9 月 30 日 尚未对开发者开放 仅限早期测试人员

GPT-6.1 Sol。 ChatGPT 发布说明称,它“在智能体编程、电脑使用和专业工作方面比 GPT-6 Sol 有所改进”。它正在 ChatGPT Work 和 Codex 中逐步推出,首先从 Pro 用户开始。OpenAI 的 API 价格页面列出的价格与 Sonnet 5.5 相同。

GPT-6 Luna。 OpenAI 的高吞吐量模型在价格上与 Haiku 5.5 最为接近。10 月 7 日的发布说明指出,Free 和 Go 用户将在“聊天”(Chat)标签页中获得 GPT-6 Luna,该推送于次日开始。我们的 GPT-6 Sol and Luna 解析文章涵盖了其发布细节。

Gemini 4 Argon。 Google DeepMind 于 9 月 30 日宣布了这一消息。其博文称,Google 将收集反馈,“然后尽快向开发者、企业和消费者提供 Argon”。目前,该博文描述的访问权限仅限早期测试人员。

欲了解 Claude 家族的顶级模型,请参阅我们的 Claude Opus 5.5 介绍文章。

为什么更快的模型仍然需要检查

更低的单 token 价格使得运行更多任务变得更容易。但这并不能免除检查输出结果的必要性。无论模型成本如何,一份包含错误数据的报告依然是一份错误的报告。

在进行这种检查时,工作空间比模型名称更重要。Powerdrill Bloom 将自己描述为“展示其工作过程的 AI 数据分析师”。其主页补充道:“每一个数字都会附带其背后的页面、行和数据来源。”

这种工作形式与 Anthropic 为其新版 Sonnet 描述的形式相匹配。您从一个电子表格或一组文档开始,最终得到一个完成的文件。Powerdrill Bloom 的价格页面列出,在付费方案中可以“创建幻灯片、Office 文档、Excel 分析和 Nano Banana 图像”。我们的 Excel to PowerPoint 页面涵盖了这一路径,而 AI report generator 页面则涵盖了书面报告。

通过测试来选择模型。然后将来源追踪保留在输出结果旁,以便审核人员能在几秒钟内确认每个数字。

如何开始使用 Sonnet 5.5 和 Haiku 5.5

如果您使用 Claude 应用程序,请在下一次处理文档、幻灯片或电子表格任务时选择 Sonnet 5.5。给它一个真实的文件和一个真实的交付目标。一份季度总结会是比玩具提示词更好的测试。

如果您基于 API 进行开发,请先切换模型 ID 并重新运行您的评估集。对比每项任务的成本,而不仅仅是单 token 的成本。一个能用更少步骤完成任务的模型,其总体成本可能会更低。

If your pipeline has a high-volume step, try Haiku 5.5 there first. Extraction and first-pass summaries are good candidates, with a larger model reviewing the result.

当您希望将电子表格转换为附带数据来源的图表、报告或幻灯片时,您可以在自己的文件上尝试 Powerdrill Bloom。

常见问题解答

什么是 Claude Sonnet 5.5?

它是 Anthropic 的 Claude 5.5 家族中的第二款模型,于 2026 年 9 月 28 日发布。Anthropic 表示,它在日常任务、修复 Bug 以及创建精美的文档、幻灯片和电子表格方面表现最强。API 价格为每百万 token 输入 $2、输出 $10。

Claude Haiku 5.5 有什么用途?

Anthropic 专为高吞吐量、成本敏感型任务(如摘要、数据库查询和分类)设计了该模型。它还可以在 Opus 5.5 或 Sonnet 5.5 旁充当子智能体(subagent)。它于 2026 年 10 月 7 日发布。

Claude Haiku 5.5 的价格是多少?

对于不超过 100K token 的提示词,其价格为每百万输入 token $0.10,每百万输出 token $0.50。对于更长的提示词,费率分别为 $0.50 和 $2.50。这些是 Claude 价格页面上显示的内容。

Sonnet 5.5 和 Opus 5.5 有什么区别?

Opus 5.5 的价格为每百万 token 输入 $4、输出 $20,是 Sonnet 5.5 费率的两倍。Anthropic 表示,在需要持续判断的复杂、开放式工作中,Opus 5.5 依然更强。Sonnet 5.5 是范围明确的日常工作速度更快的选择。

为什么 Haiku 5.5 有两个价格?

价格取决于提示词长度。不超过 100,000 个 token 的提示词使用较低的档位,更长的提示词则使用较高的档位。Anthropic 表示,对之前 Haiku 模型的请求中,约有 90% 属于较低的档位。

来源: Anthropic,介绍 Claude Sonnet 5.5 · Anthropic,介绍 Claude Haiku 5.5 · Claude Platform 发布说明 · Claude Help Center 发布说明 · Claude 价格说明 · Claude 模型概览 · ChatGPT 发布说明 · OpenAI API 价格 · Google DeepMind,Gemini 4 Argon。价格和可用性信息于 2026 年 10 月 8 日查阅自厂商页面。