
新模型在编程、网页开发、复杂文档处理和企业自动化等任务上均有提升。智东西8月14日消息,今日,谷歌发布Gemini 3.7 Flash,这是谷歌迄今面向编程和Agent场景能力最强的Flash系列主力模型。▲谷歌发布Gemini 3.7 Flash(图源:X)
距离Gemini 3.6 Flash发布仅过去三周,新模型在编程、网页开发、复杂文档处理和企业自动化等任务上均有提升,其中DeepSWE v1.1成绩从49.0%升至65.3%,与Claude Sonnet 5和GPT-5.6 Terra得分近似;AutomationBench成绩从17.0%升至30.4%。目前,在第三方模型测评机构Artificial Analysis上,Gemini 3.7 Flash(high)在Intelligence Index中取得56分,与GPT-5.6 Terra(max)、GPT-5.5(xhigh)、Grok 4.5(high)、Claude Sonnet 5(max)得分相近。▲Gemini 3.7 Flash测评情况(图源:Artificial Analysis)
价格方面,2026年年底前,Gemini 3.7 Flash每百万输入Token的价格为0.75美元(约合人民币5.06元),每百万输出Token价格为3.75美元(约合人民币25.28元),均为Gemini 3.6 Flash最初价格的一半。2027年1月1日起,两项价格将分别恢复至1.50美元(约合人民币10.11元)和7.50美元(约合人民币50.55元)。除了向开发者和企业开放,Gemini 3.7 Flash还将成为谷歌个人AI Agent Gemini Spark的新底座,帮助用户跨Gmail、Google日历、Google文档等应用执行多步骤任务。
与Gemini 3.6 Flash相比,Gemini 3.7 Flash在排查故障、解决问题等编程任务上的表现明显提升。其首次生成结果的准确率更高,生成可直接用于生产环境的程序时也有更好表现。在FrontierCode 1.1 Main测试中,Gemini 3.7 Flash得分为43.6%,与Claude Sonnet 5和GPT-5.6 Terra得分近似,领先Gemini 3.6 Flash的34.4%;在DeepSWE v1.1测试中,Gemini 3.7 Flash的成绩为65.3%,略低于GPT-5.6 Terra的69.6%。▲Gemini 3.7 Flash的编程能力(图源:谷歌)
网页开发方面,Gemini 3.7 Flash能用更少的提示,生成实用性更强的页面布局和功能较完整的应用。在根据截图、图片或完整设计系统生成UI(交互界面)时,新模型对参考设计的遵循和还原能力也有所提升。在Arena.ai的WebDev Arena测试中,Gemini 3.7 Flash的Elo得分为1588,领先Claude Sonnet 5、GPT-5.6 Terra和Muse Spark 1.2。▲Gemini 3.7 Flash的网页开发能力(图源:谷歌)
在金融、法律和生物科学等知识密集型领域,Gemini 3.7 Flash的推理能力和准确性同样有所提高。在用于测试复杂文档处理能力的GDP.pdf基准中,新模型取得34.0%的成绩,高于上一代的22.0%;在企业工作流测试AutomationBench中,其成绩由17.0%升至30.4%。▲Gemini 3.7 Flash的复杂文档处理能力及企业工作能力(图源:谷歌)
谷歌还展示了多项应用案例:Gemini 3.7 Flash配合Nano Banana,可以根据一段文本提示,生成画面精致、可玩性高的3D游戏。▲3D游戏案例(图源:谷歌)
模型还可以调用子Agent,配合Gemini Omni生成带有交互式组件的落地网页。▲交互网页案例(图源:谷歌)
谷歌称,与Gemini 3.6 Flash相比,Gemini 3.7 Flash能够更好地适应任务执行过程中遇到的障碍,在必要时确认用户意图,并更严格地遵循指令。新模型会投入更多计算完成多步骤规划和工具调用,更有条理的执行方式可以减少工程工作流中的人工监督和重复尝试。2026年年底前,Gemini 3.7 Flash每百万输入Token的价格为0.75美元(约合人民币5.06元),每百万输出Token的价格为3.75美元(约合人民币25.28元)。谷歌称,早期客户反馈认为,Gemini 3.7 Flash在保持较低成本的同时,性能和准确性均明显优于Gemini 3.6 Flash。Databricks AI研究经理伊万·周(Ivan Zhou)说:“过去,要规模化地从复杂的企业数据中获得高质量答案,成本一直很高,Gemini 3.7 Flash等模型正在改变这一状况。通过Databricks AI Gateway接入Gemini 3.7 Flash后,企业能以更低成本预测营收、识别关键客户并制定投资决策。”
谷歌同步宣布,Gemini Spark从发布当日起开始使用Gemini 3.7 Flash。Spark是谷歌在I/O大会上推出的个人AI Agent,能够全天候运行,并在用户指示和监督下代为执行任务。换用新模型后,Spark将增强对Google Workspace应用的工具调用能力,重点改善需要多项技能配合的复杂工作流。用户可以让它整合不同文件中的信息、起草邮件、更新项目状态文档,并把初步想法转化为具体操作。目前,Spark面向160多个国家和地区的Google AI Pro及Ultra订阅用户提供。个人用户则可以在支持Gemini Spark的国家和地区,通过Google AI Pro或Ultra订阅使用Gemini 3.7 Flash;开发者可通过Google Antigravity、Gemini API、Google AI Studio和Android Studio使用新模型;企业客户则可从Gemini Enterprise Agent Platform及Gemini Enterprise应用接入。
近期,Gemini应用月活跃用户突破10亿。短短三周内连发两代Flash模型、限时降低调用价格,并将新模型接入Gemini Spark,反映出谷歌正在加快Gemini模型的迭代,并继续拓展其在Agent和Workspace工作流中的应用。产品提速的同时,谷歌AI团队上周经历了重要人事调整:德米斯·哈萨比斯卸任谷歌DeepMind CEO,转任董事长;杰夫·迪恩等4名核心AI人员离职创业。未来,Gemini能否在组织调整中保持模型迭代速度,并将性能、成本和产品入口优势转化为稳定的Agent体验,值得持续关注。9月20-21日,智东西主办的2026全球AI芯片峰会将在上海举行,设有开幕式,大模型AI芯片、Agent推理芯片、具身智能芯片3场高峰论坛,以及Token工厂异构混训混推、超节点、AI芯片架构创新、新型存储器、大模型KV Cache5场技术研讨会。
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。