2026年8月13日

|

我们迄今为止最智能的编码与智能体主力模型。



图片1:浅蓝色背景上,Spark图标旁为“Gemini 3.7 Flash”文字

音频3

收听文章

[[时长]]分钟

此内容由Google AI生成。生成式AI处于实验阶段。

今天,我们在广受欢迎的Flash系列进展基础上,推出Gemini 3.7 Flash——这是我们迄今为止最智能的编码与智能体主力模型。

此次发布距Gemini 3.6 Flash仅三周,是开发者反馈和算法创新的直接成果,我们期待将这些创新应用于未来模型。3.7 Flash在软件工程、知识工作和网页开发工作流方面带来了显著改进——入门价格仅为原始3.6 Flash每百万token成本的一半。

复杂工作流更出色的智能

图片2:生产代码质量图表

图片3:长周期软件工程图表

图片4:网页开发图表

图片5:专家级PDF文档理解图表

图片6:企业工作流自动化图表

3.7 Flash在调试和问题解决等编码任务上较3.6 Flash有显著提升。它还在首次通过代码准确性上取得更高成绩,并在生成生产就绪代码方面表现更佳,如FrontierCode 1.1 Main(43.6%对比34.4%)和DeepSWE v1.1(65.3%对比49.0%)所示。

在网页开发方面,3.7 Flash能以更少的提示生成更实用的布局和功能完整的应用。在UI生成方面,该模型展现出高度的设计遵循度,并能基于参考输入(无论是截图、图像还是完整设计系统)实现同等效果。它在Arena.ai的WebDev Arena上以1588对比1538的Elo评分超越3.6 Flash。

在金融、法律和生物科学等知识密集型领域,3.7 Flash提供了改进的推理能力和准确性。它在GDP.pdf基准测试(34.0%对比22.0%)上显著超越3.6 Flash,该评估用于测试模型处理复杂文档的能力。它还在AutomationBench上超越3.6 Flash,表明它能更有效地完成真实业务工作流(30.4%对比17.0%)。

更出色的开发者体验与价格

Gemini 3.7 Flash相较3.6 Flash带来了明显改进的开发者体验。它能更好地适应障碍,在需要时澄清意图,并以更高的保真度遵循指令。它思考更严谨,在多步骤规划和工具调用上投入更多精力。更规范的执行意味着在工程工作流中减少人工监督和重试次数。

3.7 Flash在年底前以入门价格1提供:每100万输入token $0.75,每100万输出token $3.75。这一价格结合增强的模型性能,使开发者和客户能够经济高效地扩展生产就绪智能体。

图片7:性能与成本对比图

早期客户反馈凸显了3.7 Flash的性能和精准度,以低成本实现了显著优于3.6 Flash的结果。

图片8:Box的引用

图片9:Browser Use的引用

图片10:Cartwheel的引用

图片11:databricks的引用

图片12:emergent的引用

图片13:Harvey的引用

图片14:Hebbia的引用

图片15:LangChain的引用

图片16:Nunu.ai的引用

图片17:Open Code的引用

图片18:Pydantic的引用

图片19:斯坦福大学生物学系的引用

使用3.7 Flash改进Gemini Spark

Gemini Spark现已在超过160个国家面向Google AI Pro和Ultra订阅用户开放,自今日起将采用Gemini 3.7 Flash。我们在I/O大会上推出了Spark,作为您的个人AI代理,全天候运行,在您的指导下代表您采取行动。此次模型更新使Spark在知识工作方面更加高效,改进了对Google Workspace应用的工具使用能力,为复杂、多技能工作流程提供了更高的准确性和输出质量。

借助3.7 Flash,Gemini Spark可以通过整合文件、起草电子邮件和更新状态文档,更高效地将想法转化为行动。

以安全为核心构建

我们持续努力改进前沿安全防护的覆盖范围和稳健性。Gemini 3.7 Flash随附更新的防护措施,针对化学、生物、放射性和核(CBRN)及网络攻击领域的滥用风险进行防范,同时根据我们的生物韧性方法网络计划,支持有益的使用场景。

更多信息,请参阅3.7 Flash模型卡

立即试用

详细基准测试

图片20:显示AI模型基准测试的图表

在收件箱中获取Google最新资讯

订阅我们的新闻通讯,获取产品更新、活动信息、特别优惠等更多内容。

您的信息将根据Google隐私政策使用。您可以随时退出订阅。

本文内容采集自官方网站,排版和翻译可能与原页面存在差异。

阅读官方全文