资讯 · 高影响返回资讯

谷歌发布 Gemini 3.7 Flash:主打长程编程与 Agent 工作流,首发 API 降价 50%

谷歌正式发布 Gemini 3.7 Flash,主打长程代码编写与 Agent 工作流执行。模型具备 100 万 Token 上下文窗口与分级思考能力,在 DeepSWE 与 FrontierCode 等工程基准测试中较 3.6 Flash 明显提升,并在 2026 年底前提供 50% 的 API 调用折扣。

谷歌推出主力模型 Gemini 3.7 Flash

谷歌于 2026 年 8 月 13 日正式发布 Gemini 3.7 Flash,重点强化长程编程、复杂推理与 Agent 工作流执行能力。

作为 Flash 系列的最新迭代,该模型距 Gemini 3.6 Flash 上线仅相隔三周,反映出主力模型按月高速迭代的发布节奏。新模型在保持高吞吐的同时,针对多步骤自主规划与外部工具交互进行了专门调优。

即日起,开发者可通过 Google AI Studio、Vertex AI 以及 Gemini API 调用该模型。同时,Gemini 3.7 Flash 已接入 GitHub Copilot 编程助手,并作为底层引擎驱动谷歌个人智能体平台 Gemini Spark。

架构特性与可调思考能力

Gemini 3.7 Flash 标配 100 万 Token(1M)上下文窗口,单次最大支持输出 65,536 个 Token。

模型延续原生多模态架构,支持直接输入文本、代码、图像、音频、视频及长篇 PDF 文档。在系统架构层面,谷歌针对函数调用(Function Calling)、结构化 JSON 输出与上下文缓存Context Caching)实施了底层优化,显著降低了多轮交互中的延迟与成本。

此外,该模型原生集成分级思考机制,提供 Low、Medium 与 High 三档思考预算配置。开发者可以根据具体业务场景,在低延迟快速响应与深度链式推理之间灵活切换计算资源。

软件工程与 Agent 评测大幅提升

在 DeepSWE 与 FrontierCode 等关键工程基准中,Gemini 3.7 Flash 较 3.6 Flash 取得了显著的性能跨越。

官方公布的基准测试数据显示,新模型在长程代码重构、全栈 Web 开发与稠密文档理解等领域均有明显提升:

评估基准(Benchmark)测评维度 / 场景Gemini 3.6 FlashGemini 3.7 Flash提升幅度
DeepSWE v1.1长程软件工程问题定位与解决49.0%65.3%+16.3%
FrontierCode 1.1 Main生产级代码生成与缺陷修复34.4%43.6%+9.2%
WebDev Arena (Elo)端到端全栈 Web 应用构建能力15381588+50 Elo
GDP.pdf稠密金融、法律与科研文档理解22.0%34.0%+12.0%
AutomationBench企业多步骤工作流自动化执行17.0%30.4%+13.4%

在检验多文件协同修改与复杂 Bug 修复能力的 DeepSWE v1.1 基准中,Gemini 3.7 Flash 准确率达到 65.3%,大幅改善了 Agent 陷入死循环或产生幻觉的问题;而在测试超长复杂文档解析的 GDP.pdf 中,得分从 22.0% 提升至 34.0%。

定价策略与生态接入

为加速企业与开发者接入,谷歌推出首发半价优惠,将 API 输入与输出价格降至极具竞争力的水平。

官方计费方案按阶段设置优惠费率与后续标准费率:

计费阶段有效时间输入价格(每百万 Token)输出价格(每百万 Token)
限时优惠期即日起至 2026 年 12 月 31 日0.75 美元3.75 美元
标准定价2027 年 1 月 1 日起生效1.50 美元7.50 美元

开发者现可在 Google AI Studio 调试控制台中体验思考模式,或通过 Vertex AI 部署具备高并发保障的企业级生产服务。

下一步

继续追踪 Gemini 3.7 Flash

沿着同一主题继续阅读。

打开实体档案