Gemini 3.7 Flash

距离上一版更新只有三周,谷歌又发新模型了。Gemini 3.7 Flash 这次不只是小修小补。编程、Agent 和自动化能力都有明显提升,年底前价格还直接减半。它未必最强,但确实很适合开发者。
Advertisement 728 × 90
公司Google
上下文1M
发布日期2026-08
更新日期2026-08-17

Gemini 3.7 Flash 概述

Gemini 3.7 Flash 是谷歌 Flash 系列的新一代主力模型,重点强化编码和智能体(Agent)工作流,同时继续保持 Flash 一贯的高速、低成本定位。
它支持文本、图像、音频、视频等多模态输入,上下文窗口为 100 万 Token,最高输出 64K Token,知识截止时间为 2026 年 3 月。
这一代的提升主要集中在几个实际场景。
编程方面,FrontierCode 1.1 Main 从 34.4% 提升到 43.6%,DeepSWE v1.1 则从 49.0% 拉到 65.3%。Agent 场景的 AutomationBench 从 17.0% 涨到 30.4%,接近翻倍;复杂文档测试 GDP.pdf 也从 22.0% 提升到 34.0%。
网页开发同样不错,WebDev Arena Elo 达到 1588,超过 Claude Sonnet 5 和 GPT-5.6 Terra。DeepSWE 虽然进步明显,但在部分软件工程任务上,3.7 Flash 仍略逊于 GPT-5.6 Terra。
目前 Gemini 3.7 Flash 已经在 Google AI Studio、Gemini API、Antigravity 等渠道上线,普通用户也可以通过 Gemini Spark 体验。

Gemini 3.7 Flash 定价

套餐价格说明
API(2026 年底前) 输入 $0.75 / 百万 Token;输出 $3.75 / 百万 Token 约合人民币输入 5.1 元、输出 25.3 元 / 百万 Token。输出速度约 340 Token/秒,适合 Coding Agent、自动化工作流和高频调用。
API(2027 年 1 月起) 输入 $1.50 / 百万 Token;输出 $7.50 / 百万 Token 优惠结束后价格翻倍。准备长期、大规模部署的话,建议直接按这一档计算成本。
Gemini Spark 免费 面向普通用户,可跨 Gmail、日历、文档等谷歌应用执行多步骤任务,无需自行接入 API。

2026 年底前的优惠价,大约只有 Gemini 3.6 Flash 原价的一半。对调用量大的 AI 产品来说,这个折扣还是很有吸引力的。

Gemini 3.7 Flash 主要功能

1. 编程能力

3.7 Flash 这一代最明显的变化,还是软件工程能力。

FrontierCode 1.1 Main 从 34.4% 提升到 43.6%,DeepSWE v1.1 则从 49.0% 提升到 65.3%

和上一代相比,它不只是代码生成更强,在 Bug 修复、代码理解和完整软件工程任务上的表现也更稳。对 Coding Agent 来说,这种提升比单纯生成一段代码更有实际价值。

2. 网页开发

WebDev Arena Elo 达到 1588,在根据截图生成网页、还原设计稿和生成前端 UI 这类任务上表现不错,成绩也超过 Claude Sonnet 5 和 GPT-5.6 Terra。

如果平时会用 AI 做网页原型、前端页面或者根据设计稿还原 UI,这部分升级会比较直观。

3. Agent 与自动化

AutomationBench 从上一代的 17.0% 提升到 30.4%,接近翻倍。

这类测试更看重模型能不能连续调用工具、读取结果、判断下一步,再把整个任务跑完。

很多模型单步表现不错,但任务一长就容易跑偏。3.7 Flash 在多步骤执行上的进步,对企业自动化、工作流 Agent 和多工具调用场景更有意义。

4. 文档与多模态处理

GDP.pdf 从 22.0% 提升到 34.0%,主要对应复杂 PDF、商业材料和长文档问答。

财报、合同、研究报告这类内容,3.7 Flash 的处理效果比 3.6 Flash 更好。

同时,它支持文本、图片、音频和视频等多模态输入,再加上 100 万 Token 上下文,基本能覆盖大多数企业和开发场景。

随着代码、Agent 和文档能力不断往上走,Flash 已经能承担一部分过去更依赖旗舰模型的任务。反过来看,Gemini 3.5 Pro 迟迟没有迎来新一轮升级,之后 Flash 和 Pro 怎么分工,谷歌还需要把产品定位讲得更清楚。

总结

优势

Gemini 3.7 Flash 这次升级比较扎实。编程、Agent、网页开发和复杂文档处理都有明显进步,100 万 Token 上下文、多模态输入和约 340 Token/秒的输出速度,也足够覆盖大多数实际场景。

现阶段最大的优势还是价格。2026 年底前,输入只要 0.75 美元 / 百万 Token,输出 3.75 美元 / 百万 Token。对于调用量大的 AI 产品,这个成本优势很直接。

限制

它依然不是能力天花板。DeepSWE 等部分高难度软件工程测试还没有超过 GPT-5.6 Terra,100 万 Token 上下文对于极端长上下文任务也不算特别大。

2027 年开始 API 价格还会翻倍。短期试水很划算,但准备长期、大规模部署的话,不能只看现在的促销价。

Gemini Pro 系列迟迟没有更新,也让谷歌目前的产品线显得有些不平衡。

推荐人群

比较适合做 AI 编程辅助、Coding Agent、企业自动化、工作流 Agent、复杂文档处理,以及需要大量 API 调用的个人开发者和团队。

尤其是预算有限、又不想明显牺牲模型能力的 AI 创业公司,2026 年底前很适合拿真实业务跑一遍。

不推荐人群

只追求模型能力上限、成本不是主要考虑因素的用户,Flash 依然不是首选,可以继续等谷歌下一代 Pro。

需要超过 100 万 Token 上下文,或者准备长期进行超大规模调用的团队,也要提前算清楚 2027 年恢复原价后的成本。

评论(0)

发表评论

Advertisement 728 × 90

Google 模型对比

模型 上下文 定价 API 发布 全球热度
Gemini 3.7 Flash
1M $0.375 / $1.875 per 1M YES 2026-08
1M $1.500 / $7.500 per 1M YES 2026-07
96/100
1M $0.300 / $2.500 per 1M YES 2026-07
74/100
131K $0.500 / $3.000 per 1M YES 2026-06
80/100
66K $2.000 / $12.000 per 1M YES 2026-06
79/100

类似模型

关联工具

相关新闻