谷歌推出主力模型 Gemini 3.7 Flash
谷歌于 2026 年 8 月 13 日正式发布 Gemini 3.7 Flash,重点强化长程编程、复杂推理与 Agent 工作流执行能力。
作为 Flash 系列的最新迭代,该模型距 Gemini 3.6 Flash 上线仅相隔三周,反映出主力模型按月高速迭代的发布节奏。新模型在保持高吞吐的同时,针对多步骤自主规划与外部工具交互进行了专门调优。
即日起,开发者可通过 Google AI Studio、Vertex AI 以及 Gemini API 调用该模型。同时,Gemini 3.7 Flash 已接入 GitHub Copilot 编程助手,并作为底层引擎驱动谷歌个人智能体平台 Gemini Spark。
架构特性与可调思考能力
Gemini 3.7 Flash 标配 100 万 Token(1M)上下文窗口,单次最大支持输出 65,536 个 Token。
模型延续原生多模态架构,支持直接输入文本、代码、图像、音频、视频及长篇 PDF 文档。在系统架构层面,谷歌针对函数调用(Function Calling)、结构化 JSON 输出与上下文缓存(Context Caching)实施了底层优化,显著降低了多轮交互中的延迟与成本。
此外,该模型原生集成分级思考机制,提供 Low、Medium 与 High 三档思考预算配置。开发者可以根据具体业务场景,在低延迟快速响应与深度链式推理之间灵活切换计算资源。
软件工程与 Agent 评测大幅提升
在 DeepSWE 与 FrontierCode 等关键工程基准中,Gemini 3.7 Flash 较 3.6 Flash 取得了显著的性能跨越。
官方公布的基准测试数据显示,新模型在长程代码重构、全栈 Web 开发与稠密文档理解等领域均有明显提升:
| 评估基准(Benchmark) | 测评维度 / 场景 | Gemini 3.6 Flash | Gemini 3.7 Flash | 提升幅度 |
|---|---|---|---|---|
| DeepSWE v1.1 | 长程软件工程问题定位与解决 | 49.0% | 65.3% | +16.3% |
| FrontierCode 1.1 Main | 生产级代码生成与缺陷修复 | 34.4% | 43.6% | +9.2% |
| WebDev Arena (Elo) | 端到端全栈 Web 应用构建能力 | 1538 | 1588 | +50 Elo |
| GDP.pdf | 稠密金融、法律与科研文档理解 | 22.0% | 34.0% | +12.0% |
| AutomationBench | 企业多步骤工作流自动化执行 | 17.0% | 30.4% | +13.4% |
在检验多文件协同修改与复杂 Bug 修复能力的 DeepSWE v1.1 基准中,Gemini 3.7 Flash 准确率达到 65.3%,大幅改善了 Agent 陷入死循环或产生幻觉的问题;而在测试超长复杂文档解析的 GDP.pdf 中,得分从 22.0% 提升至 34.0%。
定价策略与生态接入
为加速企业与开发者接入,谷歌推出首发半价优惠,将 API 输入与输出价格降至极具竞争力的水平。
官方计费方案按阶段设置优惠费率与后续标准费率:
| 计费阶段 | 有效时间 | 输入价格(每百万 Token) | 输出价格(每百万 Token) |
|---|---|---|---|
| 限时优惠期 | 即日起至 2026 年 12 月 31 日 | 0.75 美元 | 3.75 美元 |
| 标准定价 | 2027 年 1 月 1 日起生效 | 1.50 美元 | 7.50 美元 |
开发者现可在 Google AI Studio 调试控制台中体验思考模式,或通过 Vertex AI 部署具备高并发保障的企业级生产服务。