Super Sale WeekClaude Skills — 20% OFF
News

Gemini 3.7 Flash:新功能、价格与替代方案 (2026)

Powerdrill Team·
Gemini 3.7 Flash:新功能、价格与替代方案 (2026)

Google于2026年8月13日宣布推出 Gemini 3.7 Flash,称其为“我们迄今为止用于编程和智能体(agents)最智能的主力模型”。它的价格仅为 3.6 Flash 的一半,且在其发布三周后便紧随而至。目前列出的价格为推广价,将于今年年底到期。

本文将介绍有哪些变化、实际价格是多少,以及基准测试衡量了什么。此外,本文还将探讨当您的交付物是报告或幻灯片(deck)时,该选择什么工具。数据截至2026年8月17日。

Gemini 3.7 Flash 有哪些新变化

最引人注目的是其在智能体和编程工作上的飞跃。Google 列出的目标领域包括软件工程、知识工作、Web 开发、代码生成、调试、问题解决、文档理解以及企业工作流自动化。

对于处理文件而非代码的人来说,其中有两项至关重要。文档理解企业工作流自动化是涉及电子表格、报表和报告的领域。

发布节奏本身就值得关注。Gemini 3.6 Flash 大约在三周前才发布,因此这是一次快速迭代,而非代际变革。

这种节奏带来了一个实际的影响:任何围绕特定模型版本构建的内容,都需要能够适应底层版本的快速变动。

Google 还明确将该级别定位为主力模型(workhorse),而非前沿模型(frontier model)。它旨在解决高吞吐量和成本问题,而不是用来解决您面临的最棘手的单一难题。

可用性因受众而异。开发者可以在 Google AI Studio、Android Studio 和 Google Antigravity 中使用它。企业可以通过 Gemini Enterprise Agent Platform 获取。个人用户则可以通过 Gemini Spark 使用,面向 160 多个国家的 AI Pro 和 Ultra 订阅用户。

这三个渠道并非同一种产品。在 AI Studio 中进行测试的开发者与使用 Spark 的同事,面对的是不同的界面和不同的限制。

价格以及关键日期

当前 自 2027 年 1 月 1 日起
输入 每 1M tokens $0.75 每 1M tokens $1.50
输出 每 1M tokens $3.75 每 1M tokens $7.50

Google 明确指出“推广价将于 2026 年 12 月 31 日到期”。价格翻倍是官方公布的,而非外界猜测。

与 3.6 Flash 相比,Google 将当前的价格描述为“原 3.6 Flash 每百万 tokens 成本的一半”。因此,目前的优惠是实实在在的,而且设计上是暂时的。

如果您正在规划今年之后的预算,请按 1 月份的数据进行估算。基于推广价构建的成本方案在几个月内就会失效。

反之亦然。对于在今年内结束的项目,当前的价格意味着实实在在省下的真金白银,而不仅仅是一个营销数字。

还有一个影响规划的细节:价格翻倍同时适用于输入和输出,因此两者之间的比例保持不变。

基准测试衡量了什么,又没有衡量什么

Google 公布了与 3.6 Flash 的五项对比。每一项的提升都非常显著。

基准测试 3.7 Flash 3.6 Flash
FrontierCode 1.1 Main 43.6% 34.4%
DeepSWE v1.1 65.3% 49.0%
WebDev Arena Elo 1588 1538
GDP.pdf 34.0% 22.0%
AutomationBench 30.4% 17.0%

这五项测试中有三项是编程评估。它们几乎无法告诉你该模型能否正确读取你的季度导出数据。

最接近这项工作的是 GDP.pdf,这是一项文档理解评估。请看它的绝对数值,而不是它的提升幅度:34.0% 意味着大约三分之二的项目仍然被遗漏了。

AutomationBench 的表现也是如此。从 17.0% 跃升至 30.4% 是一个很大的相对增幅,但绝对得分依然较低。

结合这两点才是最坦率的总结:这是一个在文档工作上有显著提升的模型,但文档工作依然是其表现最弱的一项。

如果您的交付物是报告或幻灯片,这会带来什么改变

更便宜、更快速的推理在改变输出质量之前,首先改变的是经济效益。Token 成本减半使得运行以前被跳过的步骤变得合理。

最显而易见的应用就是验证。当 token 价格便宜时,让模型进行第二次运行以核对数据与源头,成本微乎其微。

第二个应用是处理量。处理文件夹中的每一个文件变得完全负担得起,而不再需要进行抽样。

第三个是迭代。当第一次尝试的成本很低时,你可以用三种方式问同一个问题,然后对比答案。

无法改变的是“最后一公里”。即使模型返回了正确的数据,你仍然需要自己组装图表、书面总结和幻灯片。我们的 AI 报告生成器 页面介绍了这一组装步骤的去向。

这就是为什么每个 token 的成本不能很好地代表每个交付物的成本。在撰写报告时,token 很少是昂贵的部分。

请根据你现在能负担得起“做两次”的事情来评估这一变化。出于成本考虑,检查自己的工作通常是大多数人会跳过的步骤。

公告中未提及的三件事

上下文窗口。 公告中没有出现任何具体数值。如果您的文件很长,这一遗漏是您首先需要测试的内容。

如何处理杂乱的表格输入。 文档理解被列为一项优势,但并未说明如何处理合并单元格、多行表头或扫描表格。

Whether Spark availability equals API parity. Gemini Spark 和 API 被列为不同的渠道,且公告并未说明两者的行为完全一致。

速率限制是多少。 公告中没有出现每分钟或每天的配额,这在低价时比在高价时更为重要。

还有对规划至关重要的第四个空白:公告未提及 3.7 Flash 能维持多久的最新状态,而 3.6 Flash 仅维持了大约三周。

更快的模型在哪些方面无能为力

模型只是一个组件。衡量你工作成果的是最终的成品,而这两者之间的差距才是大部分时间真正消耗的地方。

这一差距包含三个部分:将文件整理成可用格式、确定哪些数据重要,以及制作出无需你亲自讲解同事就能看懂的内容。

请注意,只有中间部分才真正涉及智能。第一部分和最后一部分都是关于处理文件和生成格式。

这三者都无法通过更便宜的 token 来解决。它们需要通过能将文件、分析和输出整合在同一个界面上的工具来解决。

这正是 Powerdrill Bloom 所处的层面。您上传 Excel、CSV、TSV 或 PDF 文件,并在画布上进行探索。您保留的内容可以一步转化为图表、报告或幻灯片。坦白地说,它的局限性在于另一个方向:它不是一个原始的模型端点,因此您无法控制 token、温度或模型选择。

值得了解的替代方案

如果您需要 可以考虑
针对智能体和编程工作的便宜、快速的推理 Gemini 3.7 Flash
对冗长、杂乱文档的深度推理 前沿模型,而非主力级别模型
根据数据文件生成完整的图表、报告或幻灯片 具有文件上传和导出功能的操作智能体(action agent)
Google Sheet 的交互式视图 Sheets canvas,详见我们的 Sheets canvas 指南

根据您缺失的环节进行选择。如果缺失的是推理成本,那么主力模型就是答案。

请注意,这些并不是相互竞争的采购项。模型级别和交付工具处于不同的环节,大多数团队最终会同时为两者付费。

如果缺失的是最终的成品,更便宜的模型也无法生成它。这属于不同的工具类别,而不是更弱的类别。

结论

Gemini 3.7 Flash 在智能体和文档工作上取得了真正的进步,且成本仅为之前的一半,而这一半的成本优惠是暂时的。这就是值得记住的三个事实。

需要关注的数据是 GDP.pdf 的 34.0%。提升与足够是两码事,文档理解依然是需要您亲自验证的领域。

如果您的工作最终需要生成图表、书面总结或幻灯片,请在您自己的文件上尝试 Powerdrill Bloom。另请参阅我们的智能体插件指南以及什么是 MCP

常见问题解答

什么是 Gemini 3.7 Flash?

它是 Google 于 2026 年 8 月 13 日宣布推出的主力级别模型,被描述为其迄今为止用于编程和智能体最智能的主力模型。Google 将编程、知识工作、文档理解和企业工作流自动化列为其目标领域。

Gemini 3.7 Flash 的价格是多少?

目前为每百万输入 tokens $0.75,每百万输出 tokens $3.75。Google 表示,该推广价将于 2026 年 12 月 31 日到期,之后将适用 $1.50 和 $7.50 的价格。

它比 Gemini 3.6 Flash 更好吗?

Google 公布了其对比的所有五项基准测试的提升,包括 FrontierCode 1.1 Main 达到 43.6%(相比 34.4%)。它还将当前价格列为原 3.6 Flash 每百万 tokens 成本的一半。

它的上下文窗口有多大?

公告中未说明上下文窗口的具体数值。如果长文件对您的工作至关重要,请自行进行测试,而不要假设它与其他级别相同。

它能将电子表格转化为演示文稿吗?

模型返回的是文本和推理,而不是格式化的幻灯片。根据数据文件制作幻灯片需要能够处理文件和导出的工具,这与模型是不同的层面。