大模型价格战现分歧:DeepSeek涨价之际,谷歌Gemini 3.7 Flash限时五折抢滩

科技区角 2026-08-14 15:30

【科技纵览】当国内头部模型厂商刚刚上调服务费率,大洋彼岸的谷歌却反其道而行之,祭出激进的折扣策略。这种看似矛盾的市场动向,实则揭示了AI大模型竞争正从单纯的参数军备竞赛,转向更为务实的规模化落地与成本控制博弈。

当地时间8月13日,谷歌正式对外发布新一代主力模型Gemini 3.7 Flash。相较于性能指标的常规迭代,此次更新最令开发者群体侧目的,是一项极具诱惑力的限时促销方案。在今年剩余的四个月里,该模型每百万token的输入与输出价格分别被压低至0.75美元和3.75美元。这一价格仅为前代产品Gemini 3.6 Flash标准定价的一半。当然,这并非永久性的价格下调。自2027年元旦起,其费率将回调至输入1.5美元、输出7.5美元的水平。换言之,谷歌实质上是向市场发放了一张有效期仅四个多月的“半价体验券”。

刚刚履新谷歌DeepMind高级副总裁的科拉伊·卡武库奥卢(Koray Kavukcuoglu)在社交媒体上阐释了此次更新的初衷。他指出,Gemini 3.7 Flash是专为编码任务及代理工作流打造的核心模型。“我们在Flash系列上的迭代节奏极快,从3.5版本到3.7版本的跨越仅耗时三个月,旨在让其在更广泛的任务场景中提供实质性帮助。”值得注意的是,就在一个月前的7月,谷歌才密集发布了包括Gemini 3.6 Flash在内的三款新模型。如今不到三十天,Flash系列再次迎来版本跃迁,显示出极高的研发周转效率。

第三方评测机构Artificial Analysis的数据为这一速度提供了注脚。在高推理模式测试中,Gemini 3.7 Flash的智能得分达到56分,较3.6版本提升4分,位列榜单第九。这一成绩不仅超越了同期发布的国产模型DeepSeek V4 Pro 0813,也高于智谱GLM-5.2,后两者在同等条件下的得分均为53分。然而,速度才是3.7 Flash真正的杀手锏。其输出速率高达每秒约340个token,几乎是GPT-5.6 Terra和GLM-5.2的三倍。即便在高推理模式下,完成平均任务仅需1.7分钟。这种在智能水平与响应时间之间取得的精妙平衡,恰恰契合了谷歌对Flash系列的定位:不盲目争夺能力榜首,而是追求适合大规模部署的综合性价比。

成本优势在这一策略下被进一步放大。据Artificial Analysis测算,在当前的折扣期内,Gemini 3.7 Flash在高推理模式下的单任务平均成本约为0.4美元,较3.6版本降低30%;若切换至中等推理模式,成本更可压缩至0.26美元。有开发者感慨,对于智能体应用而言,每百万输入token仅0.75美元的报价“便宜得近乎疯狂”。这意味着,即便是将整个Next.js代码库投入上下文进行自动重构,也不至于导致API预算崩溃。这对于独立开发者而言,无疑是一次巨大的胜利。

显然,谷歌意在通过低价策略降低开发者的试用门槛与迁移阻力,进而确立Flash系列在智能体时代的默认地位。不过,业内也存在冷静的声音。部分开发者指出,虽然低廉的价格极具吸引力,但智能体应用的核心挑战在于长周期任务中的可靠性。一个模型能否在数百个步骤的执行过程中保持逻辑一致,不出现隐性偏差或决策失误,仍需时间的验证。

与此同时,另一个悬念笼罩着业界:谷歌的旗舰级模型究竟去向何方?早在今年5月的I/O开发者大会上,谷歌曾预告Gemini 3.5 Pro已在内部使用,并预计“次月”推出。然而三个月过去,这款备受期待的Pro版本仍未露面。与之形成鲜明对比的是,Flash系列已从3.5迅速演进至3.7。市场由此产生一种推测:谷歌可能正在调整其AI竞争战略,不再执着于像fable那样参数庞大、成本高昂的超前沿模型,转而聚焦于性价比更高的Flash级别产品,试图以更大的调用量和更广的产品覆盖来构建护城河。截至目前,谷歌官方对此传闻未予置评。

在此次发布前夕,谷歌DeepMind内部经历了一场深刻的人事震荡。创始人兼CEO德米斯·哈萨比斯(Demis Hassabis)卸任日常管理职责,转任董事长及Alphabet首席科学家;卡武库奥卢晋升高级副总裁;而在谷歌效力近27年的传奇工程师杰夫·迪恩(Jeff Dean)则选择离职创业。坊间传言,DeepMind部门未来或将面临进一步的重组。回顾去年,谷歌曾凭借Gemini 3 Pro实现了一次漂亮的逆袭,图像模型Nano banana也收获了良好口碑。但步入2026年,模型延期、核心高管变动以及竞争对手的密集攻势,使得这家科技巨头的AI航向显得扑朔迷离。

尽管AI行业的风云变幻从未停歇,没有任何玩家能长期稳坐王座,落后的技术也能迅速补课追赶。但不可否认,谷歌手中仍握有其他模型公司难以复制的底牌:自研芯片体系、庞大的算力储备以及海量的产品入口。未来的格局究竟如何演变,或许只有时间能给出答案。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
EMI 大模型
more
Omilia获6700万美元B轮融资,CEO直言“杀鸡焉用牛刀”:拒绝盲目堆砌大模型
8GB 内存也能跑 Kimi K3?2026 本地部署大模型配置全指南
Deepseek V4 Pro 正式版 API 上线,百万 Token 仅 6 元;腾讯计划近期发布 HY4 大模型;曝 iPhone18 至少涨价 2000 元起 | 极客早知道
Day 0支持!DF系列AI 大模型推理一体机完成 Qwen3.8-27B 全适配,FlagOS 全栈加持高性价比本地大模型落地
李开复直言:中国开源大模型正引发美国业界深层焦虑
大模型开始卷「越狱」了
AI浪潮下的就业悖论:科技巨头一边豪赌大模型,一边挥刀裁员
宇树科技携手DeepSeek,具身智能与大模型深度绑定
AI成本焦虑下的破局:Writer发布Palmyra X6,以“架构优化”对抗大模型通胀
小米智能摄像机4 Max AI变焦版正式开售:内置AI大模型,京东券后739元
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号