← 返回每日热点
BiFish original · 2026-08-14

谷歌3周就出新模型,价格砍半,这次是真急了?

价格战打到骨折 同一个API调用请求,上周你还在用 Gemini 3.6 Flash 跑代码,每百万 Token 输入要花 1.5 美元;今天再看,同样的活儿,3.7 Flash 只要 0.7

01

价格战打到骨折


同一个API调用请求,上周你还在用 Gemini 3.6 Flash 跑代码,每百万 Token 输入要花 1.5 美元;今天再看,同样的活儿,3.7 Flash 只要 0.75 美元。

价格直接腰斩。而且回头一看,距离 3.6 Flash 发布才过了三周。

三周。

作为一个被各种 AI 工具坑过无数次的人,我看到这个节奏的第一反应不是兴奋,是警惕。谷歌这波操作,与其说是技术迭代,不如说是一次精心计算的市场进攻。他们不是在卖模型,是在抢开发者的时间和习惯。

02

这次升级到底改了啥


先说说这次 3.7 Flash 的核心卖点:专为编程与 Agents 场景打造

具体来说,谷歌官方表示在软件工程、知识工作及网页开发工作流方面均实现了大幅提升。这个描述很宽泛,但从定价策略和发布节奏来看,我能给出一个比较明确的判断:这次升级的核心目的不是推技术天花板,而是在中端市场建立成本优势

原因很简单。Flash 系列定位是“轻量快速”,不是 Gemini Ultra 那种追求极致推理能力的旗舰。谷歌给它配的定价是每百万 Token 输入 0.75 美元、输出 3.75 美元——这个价格带直接对标的是 Anthropic 的 Claude Sonnet 和 OpenAI 的 GPT-4o-mini。在 Agents 和编程这两个垂直场景里,Flash 的策略就是用足够低的价格,让开发者在成本敏感的批量调用场景里,没理由不选它。

从数据来看,谷歌这次的定价策略非常激进。原价基础上直接打五折,而且 3.6 Flash 也享受同等优惠,有效期到 2026 年底。这意味着谷歌愿意在长达一年多的时间里,用低于成本或接近成本的价格来换取市场份额。

03

谁最该紧张


谷歌这波降价,最直接的冲击对象是 Anthropic 和 Meta 的开源模型阵营。

我们来做个对比。Claude Sonnet 4.5 目前的定价是每百万 Token 输入 3 美元、输出 15 美元。OpenAI 的 GPT-4o-mini 输入是 0.15 美元、输出 0.6 美元。而 Gemini 3.7 Flash 的定价 0.75/3.75 美元,正好卡在两者之间,但更接近 GPT-4o-mini 的区间。

这里有个关键问题:谷歌声称 3.7 Flash 在编程和 Agents 场景有大幅提升。如果这个提升是真实的,那意味着它在特定场景下的性价比可能比 GPT-4o-mini 还高——因为 GPT-4o-mini 的能力天花板相对有限,而 Flash 系列一直有更强的推理底子。

对 Anthropic 来说,压力更大。Claude 的定价一直是行业偏高的,它靠的是品牌溢价和对企业客户的绑定。但当一个能力相近、价格只有四分之一的替代品出现时,那些还在犹豫的企业采购负责人会怎么选?答案不言而喻。

对 Meta 和开源阵营来说,情况也不乐观。Llama 系列的优势一直是“免费”,但部署和运维有隐性成本。当谷歌把闭源模型的价格打到这个程度,自建开源模型部署的成本优势就被大幅压缩了。

04

普通开发者该关心什么


如果你是一个正在做 AI 产品的创业者或者后端开发者,谷歌这波操作跟你关系很大。

想象一个实际场景:你在做一个代码审查工具,每天需要处理数千个 Pull Request,每个 PR 需要调用模型分析代码质量、生成审查意见。假设每个 PR 平均消耗 5000 Token 输入、2000 Token 输出。

1用 Claude Sonnet 4.5:每百万 Token 输入 3 美元,输出 15 美元

2用 Gemini 3.7 Flash:每百万 Token 输入 0.75 美元,输出 3.75 美元

跑同样数量的 PR,后者的 API 成本只有前者的四分之一不到。对于一个日调用量在百万级别的产品来说,这个差距每年能省下六位数甚至七位数的美元。

所以,这次降价的真正意义不是谷歌多便宜,而是它重新定义了中端模型的价格锚点。以后你再评估任何 API 服务,都会不自觉地拿这个价格去比较。

05

谷歌在下什么棋


如果你只看到“降价”两个字,那就低估了谷歌的野心。

这次 Gemini 3.7 Flash 的发布,还有一个关键信息容易被忽略:Gemini Spark 将正式接入该模型,面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户推出。Spark 是什么?它是谷歌嵌入 Workspace 的 AI 助手,覆盖 Docs、Sheets、Gmail 等全线产品。

这意味着什么?谷歌在用一个极其便宜的 API 价格,同时撬动两个市场:

1企业市场:通过 Workspace 绑定,让 AI 成为办公套件的默认能力

2开发者市场:通过极低的 API 价格,抢占 Agents 和编程工具的底层调用份额

这种双线作战的策略,在 AI 行业里只有谷歌和微软有资源打。微软有 OpenAI 的模型 + Office 365 的分发渠道,谷歌有自研模型 + Workspace 的分发渠道。其他玩家,无论是 Anthropic 还是 Meta,都没有这种“模型 + 分发”的闭环能力。

从这个角度看,谷歌的真正竞争对手不是 OpenAI,是微软。而这次降价,更像是在微软和 OpenAI 的联盟面前,主动发起的一次价格攻势。

当然,以上这些都是基于谷歌自己的宣传数据。3.7 Flash 在编程和 Agents 场景到底比 3.6 强多少,目前还不好说,需要更多独立评测和实际样本验证。谷歌这次发布的节奏太快了——三周一个版本——让人很难不怀疑这更多是营销驱动而非技术驱动。

但作为一个被各种 AI 工具坑过无数次的人,我得说:价格战从来不是长久之计。当所有模型都在卷价格的时候,真正决定胜负的,是你能不能在开发者心里建立起“默认选择”的地位。谷歌现在就是在赌这一把。

当然,如果你只是一个用 ChatGPT 聊聊天、写写周报的普通用户,以上这些对你来说可能完全没用。

本文基于 media 公开报道编译解读,查看原文

公开来源
  1. 谷歌推出 Gemini 3.7 Flash 模型,首发优惠价为原 3.6 Flash 的一半