DeepSeek涨价,谷歌降价:新模型限时五折
这边DeepSeek刚涨价,另一边谷歌开始打五折了,大模型市场的价格策略开始走向两个方向。
当地时间8月13日,谷歌发布新模型Gemini 3.7 Flash,相比性能提升,更受开发者关注的是一项限时促销:今年年底前,该模型每百万token的输入、输出价格分别为0.75美元和3.75美元,只有Gemini 3.6 Flash标准价格的一半。
不过,这并不是一次永久降价。2027年1月1日起,Gemini 3.7 Flash的价格将恢复至每百万token输入1.5美元、输出7.5美元。因此,谷歌更多是为开发者提供了一张有效期四个多月的“五折体验券”。
刚刚升任谷歌DeepMind高级副总裁的科拉伊·卡武库奥卢(Koray Kavukcuoglu)发帖提到,今天推出的Gemini 3.7 Flash是最新的主力模型,专为编码和代理工作流设计。
“我们一直在 Flash 系列上快速迭代,从3.5到3.7只用了3个月,使其在广泛的任务中变得更有帮助。”卡武库奥卢称。
就在7月,谷歌才一口气推出了三个模型,其中包括Gemini 3.6 Flash,如今不到一个月,Gemini Flash系列再次迎来更新。
AI大模型评测机构Artificial Analysis的测试显示,在高推理模式下,Gemini 3.7 Flash的智能得分为56,比 3.6 Flash 提高了4分,排在榜单第9位,超过了国内同期上新的DeepSeek V4 Pro 0813和智谱的GLM-5.2,后二者在最高推理下的得分均为53。

与此同时,速度是3.7 Flash更突出的优势。其输出速度约为每秒340个token,接近GPT-5.6 Terra和GLM-5.2的3倍;在高推理模式下,3.7 Flash平均任务时间 1.7 分钟,目前是平衡了智能与任务时间的最优模型。
这也延续了谷歌对Flash系列的定位,不争夺能力榜首,但要在智能、速度和成本之间寻找更适合规模化部署的平衡点。
Artificial Analysis的成本测算显示,在目前的折扣价格下,Gemini 3.7 Flash在高推理模式下的单任务平均成本约0.4美元,比 Gemini 3.6 Flash低 30%,中等推理模式下则进一步降至0.26美元。
有开发者表示,每百万输入token仅0.75美元对一个智能体模型来说“便宜得有些疯狂”。这意味着,“把整个Next.js代码库丢进上下文,让它自动重构也不至于把 API预算搞破产,这对单打独斗的开发者来说是个大胜利。”
谷歌显然也看中了这一点,其策略更像是用低价降低开发者试用和迁移成本,再争取让Flash成为智能体时代的默认工作模型。
不过,也有开发者认为,虽然价格很有吸引力,但对于智能体来说,更大的考验是在长时间任务中的可靠性。一个模型可以很快且成本低廉,但它是否能在不悄然偏离或做出错误决定的情况下完成数百个步骤,这很重要,也需要时间去验证。
在3.7 Flash更新的同时,另一个更受关注的问题是:谷歌的旗舰模型去哪了?
今年5月,谷歌在I/O开发者大会上预告,Gemini 3.5 Pro已在公司内部使用,预计“下个月”推出。但三个月过去,3.5 Pro仍未露面。与此同时,Flash系列却从3.5迅速更新到3.7,目前的趋势是:主力模型一路小跑,旗舰模型却迟迟没有更新。
市场甚至有传言称,谷歌正在调整AI竞争策略,不再押注fable那样参数更大、成本更高的超大规模前沿模型,转而聚焦到性价比更高的Flash级别模型上,将优势转化为更大的调用量和更广泛的产品覆盖。目前谷歌并未就此有任何回应。
在此次发布前一周,谷歌DeepMind刚完成了一次权力交接,创始人兼CEO德米斯·哈萨比斯(Demis Hassabis)交出日常管理职责,转任Google DeepMind董事长及Alphabet首席科学家;卡武库奥卢升任高级副总裁;在谷歌工作近27年的传奇工程师杰夫·迪恩(Jeff Dean)离职创业。有传言称DeepMind部门未来还将面临重组。
去年,谷歌曾凭借Gemini 3 Pro实现一场漂亮的逆风翻盘,图像模型Nano banana也广受好评。但进入2026年,模型延期、核心人事变动和竞争对手密集上新,又让它的AI航向显得不那么确定。
当然,AI行业变动频繁,从来没有谁可以长期坐稳王座,落后的模型很快也能补上课赶上来。谷歌仍然拥有其他模型公司难以复制的筹码:自研芯片、算力、海量产品入口,未来的格局很难预测。
