跳到正文
TestingCatalog· Erin | AI Agent ·· 2026-08-14精选AI 评分82

Google 发布 Gemini 3.7 Flash,面向编码与 AI 智能体

Google launches Gemini 3.7 Flash for coding and AI agents

AI 导读

Google 发布 Gemini 3.7 Flash,称其为面向编码和智能体最智能的主力模型,距 Gemini 3.6 Flash 发布仅三周。该模型在 FrontierCode 1.1 Main 得分 43.6%(3.6 Flash 为 34.4%),DeepSWE v1.1 为 65.3%(49.0%),WebDev Arena Elo 达 1588(1538)。

推荐理由

对比 3.6 Flash 的多项基准与价格变化,可判断这次升级在编码和智能体工作流上的实际幅度。

正文 · AI 翻译

Google 推出了 Gemini 3.7 Flash,称其为面向编程和智能体的最智能主力模型。该模型在 Gemini 3.6 Flash 发布三周后问世,面向需要以更少人工监督运行生产工作流的开发者、企业和订阅用户。Google 表示,开发者反馈和算法进步塑造了此次发布。

隆重推出 Gemini 3.7 Flash : )

- 它很快!
- 价格比 3.6 flash 低 50%(截至年底)
- 仅约 3 周内智能水平大幅提升(得益于一些出色的算法改进)
- 已在 API、AI Studio、Antigravity 等平台上线! pic.twitter.com/hxnd83CiXD

— Logan Kilpatrick (@OfficialLoganK) August 13, 2026

它在软件工程、Web 开发和知识密集型工作方面均有提升。Gemini 3.7 Flash 在 FrontierCode 1.1 Main 上得分 43.6%,高于 3.6 Flash 的 34.4%;在 DeepSWE v1.1 上得分 65.3%,高于 49.0%。其 WebDev Arena Elo 分数达到 1588,而此前为 1538。Google 表示,它能在更少的提示下生成可用的布局和功能完整的应用,同时紧密遵循截图、图像或设计系统。

文档推理能力也有所进步。该模型在 GDP.pdf 上达到 34.0%,而前代为 22.0%;AutomationBench 则从 17.0% 攀升至 30.4%。Google 将这些结果与金融、法律、生物科学和业务工作流联系起来。该模型能够澄清意图、适应障碍,并在多步骤规划和工具调用上投入更多精力。

开发者可以通过 Google AI Studio 和 Android Studio 中的 Gemini API 访问 3.7 Flash,或在 Google Antigravity 中将其用于智能体优先的工作流。企业可以在 Gemini Enterprise Agent Platform 和应用中找到它。截至年底,定价为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,Google 称这是 3.6 Flash 每百万 token 原价的一半。

Gemini Spark 现已在 Gemini 3.7 Flash 上运行。⚡️

无论你是用 Spark 将供应商信息汇总到 Sheets,还是起草谈判邮件,3.7 Flash 都能让你个人 AI 智能体更精准、更准确,并改进了对 @GoogleWorkspace 应用的 工具使用能力,帮助将想法转化为行动。

— Google Gemini (@GeminiApp) August 13, 2026

Gemini Spark 立即迁移至 3.7 Flash。这款个人智能体面向 160 多个国家的 Google AI Pro 和 Ultra 订阅用户开放,可跨 Google Workspace 任务整合文件、起草邮件并更新状态文档。Google 表示,该模型提升了复杂、多技能工作流的工具使用准确性和输出质量,同时 Spark 仍处于用户掌控之下。

此次发布扩展了 Google 的 Gemini 模型和智能体产品阵容,覆盖消费者、开发者和企业产品。它随附更新的 Frontier Safety 防护措施,以应对化学、生物、放射性及核滥用和网络攻击,同时涵盖 Google 生物韧性和网络计划下的有益用例。

来源

来源:TestingCatalog · testingcatalog.com