Gemini 3.7 Flash:降价 50%,编码优先(2026 年 8 月)

Gemini 3.7 Flash 以 $0.75/$3.75 每百万 token 发布,比 3.6 Flash 便宜一半。100万上下文、多模态、可调思维、强工具调用。

8 月 13 日,Google DeepMind 发布 Gemini 3.7 Flash——距离 3.6 Flash 仅 23 天。3.6 Flash 发布后口碑不佳,社区反响冷淡,被 DeepSeek V4 Flash 以十分之一的价格在 Agent 基准上碾压。Google 的应对方式很直接:价格砍半,直接把入门价定在 $0.75/$3.75 每百万 token,同时在编码和工具调用方面做了实质性提升。

我测了两天。相比 3.6 的改进是真实的,特别是软件工程任务和工具调用可靠性。但”有改进”和”值得从 DeepSeek V4 Flash 切换”是两码事。

Google DeepMind 发布 Gemini 3.7 Flash 的博客页面

先说结论

  • Gemini 3.7 Flash:$0.75 输入 / $3.75 输出(百万 token),优惠价持续到 2026 年 12 月 31 日。2027 年 1 月起恢复 $1.50/$7.50
  • 比 3.6 Flash 便宜 50%——Google 对市场竞争的直接回应
  • 100 万 token 上下文,多模态(文本、图片、视频、音频、PDF),可调思维深度
  • 工具调用和 Agent 能力显著增强。软件工程、知识工作、Web 开发均有提升
  • 通过 Gemini API、AI Studio、Antigravity 可用
  • 即便如此,仍比 DeepSeek V4 Flash 贵 5 倍(输入)到 13 倍(输出)

为什么 23 天就出新版

先说背景。Gemini 3.6 Flash 7 月 21 日发布后,立刻被拿来跟 DeepSeek V4 Flash 比较——后者在大多数 Agent 基准上更强,价格却只有 3.6 Flash 的零头。已经集成了 DeepSeek V4 Flash($0.14/$0.28)的开发者看不到付 10 倍价格的理由。

Google 的反应很快:23 天内推出 3.7 Flash,价格减半,质量在编码和工具调用两个对 Agent 最关键的维度上做了明显提升。对 Google 来说,23 天出一个大版本很不寻常——说明他们确实感受到了压力。

模型规格

参数数值
发布日期2026 年 8 月 13 日
优惠输入价$0.75 / 百万 token
优惠输出价$3.75 / 百万 token
正式价格(2027年1月起)$1.50 输入 / $7.50 输出 / 百万 token
上下文窗口1,000,000 token
多模态文本、图片、视频、音频、PDF
思维模式可调(关闭 / 低 / 中 / 高)
工具调用原生函数调用、并行工具
可用平台Gemini API、AI Studio、Antigravity
许可证私有(仅 API 访问)

可调思维模式值得一提。你可以按请求调节从”关闭”(最快最便宜)到”高”(更慢更深思熟虑)。简单路由决策关掉思维,复杂代码生成或多步规划拉满。这让你在同一模型部署内实现成本控制。

定价对比:2026 年 8 月的 Agent 模型市场

模型输入($/百万 token)输出($/百万 token)上下文备注
Gemini 3.7 Flash$0.75$3.75100万优惠价持续到 2026 年 12 月
Gemini 3.6 Flash$1.50$7.50100万实际已淘汰
DeepSeek V4 Flash$0.14$0.28100万MIT 开源,可自部署
Claude Sonnet 4$3.00$15.00200K工具调用最强
GPT-5.5$2.50$10.00256KOpenAI 中端
Gemini 3.7 Flash(正式价,2027年1月)$1.50$7.50100万和 3.6 Flash 一样的价

Google 的尴尬在于:即便半价,Gemini 3.7 Flash 的输入仍是 DeepSeek V4 Flash 的 5.4 倍,输出是 13.4 倍。优惠价本质上是 Google 在买时间——2027 年 1 月回到 $1.50/$7.50 后,就和 3.6 Flash 一模一样了。

但在 Claude Sonnet 4 和 GPT-5.5 面前,3.7 Flash 确实有性价比优势:比 Sonnet 4 便宜 4 倍。对于 DeepSeek V4 Flash 质量不够但 Sonnet 4 又太贵的团队,3.7 Flash 填补了中间地带。

Gemini 3.7 Flash 与竞品模型定价对比

Agent 能力提升在哪里

Google 宣传三个改进方向:软件工程、知识工作、Web 开发。我的实测观感:

工具调用和函数调用

3.7 Flash 处理复杂多工具 schema 比 3.6 可靠很多。幻觉工具参数或调用顺序错误的情况明显减少。对于依赖结构化工具调用的 Agent 框架,这是最关键的改进。

编码任务

模型首次生成的代码更完整,处理大文件上下文更好,不完整实现需要追问的情况减少。这直接降低了编码 Agent 循环的迭代次数,从而降低成本和延迟。

可调思维的成本优化

思维深度让你按任务复杂度匹配算力。Agent 中的典型用法:

from openai import OpenAI

client = OpenAI(
    base_url="https://generativelanguage.googleapis.com/v1beta/openai/",
    api_key="YOUR_GEMINI_API_KEY"
)

# 简单路由——关闭思维追求速度
route_resp = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "哪个工具负责文件上传?"}],
    extra_body={"thinking": {"level": "off"}}
)

# 复杂代码生成——思维拉满追求质量
code_resp = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "用依赖注入重构这个模块..."}],
    extra_body={"thinking": {"level": "high"}}
)

这种模式让你在同一个模型上运行整个 Agent,只在质量真正需要的地方多花算力。

100 万上下文:差异点在哪

100 万 token 上下文窗口和 DeepSeek V4 Flash 一样,所以不再是差异化优势——这是 Agent 级模型的基本门槛了。真正的差异在于:多模态输入。如果你的 Agent 需要在工作流中处理截图、读取 PDF 或分析视频帧,3.7 Flash 原生支持,不需要预处理步骤。

对于处理大型代码仓库的编码 Agent,和 DeepSeek V4 百万上下文一样的建议:窗口是余量空间,不是让你每次都塞满的。

适合谁用

三个明确的使用场景:

  1. 多模态 Agent 工作流。 如果你的 Agent 需要处理图片、PDF 或视频,3.7 Flash 的原生多模态 + 100 万上下文是最干净的方案。

  2. 锁定 Google Cloud 的团队。 如果你已在 Vertex AI 上或因合规需要留在 Google 生态,3.7 Flash 是那里最好的 Agent 模型。

  3. 中等价位承受力。 DeepSeek V4 Flash 质量不够但 Sonnet 4 太贵的情况下,3.7 Flash 填补中间层。

不需要切换的人: 已经对 DeepSeek V4 Flash 质量满意的人,或需要最强工具调用可靠性的人(那还是 Claude Sonnet 4)。

Gemini AI Studio 中的 3.7 Flash 模型配置和思维深度设置

Google 的定价策略

2026 年 12 月前的优惠价明确是抢地盘。Google 赌的是:开发者一旦在 $0.75/$3.75 上构建了系统,切换成本会让他们留下来,即使 1 月价格翻倍。和云厂商搞计算折扣是一个套路。

如果你今天在设计 Agent 系统,按正式价 $1.50/$7.50 建模成本。把折扣当额外利润,别当基线经济模型。

FAQ

优惠价是永久的吗?

不是。Google 明确表示 $0.75/$3.75 持续到 2026 年 12 月 31 日。2027 年 1 月 1 日起翻倍到 $1.50/$7.50。做规划时要考虑正式价。

Gemini 3.7 Flash 和 DeepSeek V4 Flash 比,做编码 Agent 谁更好?

DeepSeek V4 Flash 明显更便宜($0.14/$0.28 vs $0.75/$3.75),编码基准也很强(Terminal-Bench 82.7)。Gemini 3.7 Flash 优势在多模态支持和可调思维。如果你的 Agent 是纯文本编码,DeepSeek 成本优势碾压。如果工作流中需要处理截图或 PDF,Gemini 有优势。

可以通过 SandBase 使用 Gemini 3.7 Flash 吗?

可以。SandBase 通过标准 OpenAI 兼容端点路由到 Gemini 3.7 Flash。模型标识符用 google/gemini-3.7-flash

“可调思维”实际用法是什么?

每个 API 请求可以指定思维等级:关闭、低、中、高。高等级在复杂任务上质量更好,但消耗更多 token、耗时更长。Agent 路由决策用”关闭”,代码生成或多步规划用”高”。

应该从 Claude Sonnet 4 切换到 Gemini 3.7 Flash 吗?

只有成本是首要考虑时才该换。Claude Sonnet 4 在工具调用可靠性和代码质量上仍是前沿模型中最强的。Gemini 3.7 Flash 便宜 4 倍,但在复杂 Agent 工作流的精度上比不了 Sonnet 4。切换前先用你的真实任务对比测试。

总结

Gemini 3.7 Flash 是 Google 承认 Agent 模型市场跑得比预期快的表现。半价策略和 23 天的迭代速度说明了竞争格局。模型本身确实好——更好的工具调用、更好的编码、可调思维——但它落地的市场里,DeepSeek V4 Flash 以 15% 的成本提供 80% 的质量。

如果你的 Agent 循环需要多模态能力,或者你锁定在 Google 生态里,3.7 Flash 是正确选择。对其他人来说,价值取决于质量差距是否能撑起 5-13 倍的价格溢价。优惠价阶段值得测试。2027 年 1 月正式价,这笔账就不太好算了。