谷歌 DeepMind 于 8 月 13 日发布新一代模型 Gemini 3.7 Flash,这是其 Flash 系列的最新版本,专为编码和智能体任务设计,号称“迄今最智能的通用模型”。该模型距离上一代 3.6 Flash 发布仅三周,谷歌表示这是直接响应开发者反馈并应用算法创新的结果。

在性能方面,3.7 Flash 在软件工程、知识工作和网页开发等任务上均有显著提升。在编码基准测试中,FrontierCode 1.1 Main 得分从 3.6 Flash 的 34.4% 提升至 43.6%DeepSWE v1.1 得分从 49.0% 提升至 65.3%,显示出更高的首次通过准确率和生成生产级代码的能力。在网页开发领域,其 WebDev Arena Elo 评分达到 1588,高于 3.6 Flash 的 1538,能生成更实用的布局和功能完整的应用。此外,在金融、法律和生物科学等知识密集型领域,3.7 Flash 在 GDP.pdf 基准上得分从 22.0% 跃升至 34.0%,在 AutomationBench 上从 17.0% 提升至 30.4%,表明其能更有效地完成真实业务流程。

价格方面,3.7 Flash 的输入价格为每百万 tokens 0.75 美元输出价格为每百万 tokens 3.75 美元,约为 3.6 Flash 原始价格的一半。该优惠价持续至 2026 年底,2027 年 1 月 1 日起将调整为输入 1.50 美元、输出 7.50 美元。谷歌表示,这一价格结合增强的性能,使开发者能够以更低成本规模化部署生产级智能体。

谷歌同时宣布,Gemini Spark(面向 Google AI Pro 和 Ultra 订阅用户、覆盖 160 多个国家的 24/7 个人智能体)将从即日起采用 3.7 Flash。此次更新提升了 Spark 在知识工作方面的效率,改进了对 Google Workspace 应用的工具使用,能更高效地整理文件、起草邮件和更新状态文档。

在安全方面,3.7 Flash 加强了针对化学、生物、放射性和核(CBRN)以及网络攻击等领域的滥用防护,同时支持有益用例。开发者可通过 Google Antigravity、Gemini API、Google AI Studio 和 Android Studio 使用该模型,企业用户则可通过 Gemini Enterprise Agent Platform 访问。

此次发布距离 3.6 Flash 仅三周,显示出谷歌在大模型领域的快速迭代节奏。分析人士认为,更低的定价和更强的性能将加剧与 OpenAIAnthropic 等对手的竞争,同时也可能推动更多企业采用 AI 智能体,进而带动对算力基础设施的需求。