Google 已将 Gemini 3.7 Flash 模型的价格在 12 月 31 日前下调了 50%,每百万输入 token 收费 0.75 美元,每百万输出 token 收费 3.75 美元。此次降价直接影响到构建 AI agent 的开发者,较低的成本可能会改变开发者留在 Google 平台还是转向竞争对手的决策。
为什么这次折扣现在很重要
Gemini 3.7 Flash 是处理重度编码和以自动化为中心的工作负载的一种快速且廉价的选择。Google 发布了新的基准测试数据,显示该模型在 agent 相关任务上的差距正在缩小:DeepSWE v1.1 从 49.0% 上升到 65.3%,FrontierCode 从 34.4% 上升到 43.6%,Zapier AutomationBench 从 17.0% 上升到 30.4%。对于运行高频数据提取或工具调用(tool-calling)循环的团队来说,这些提升至关重要,因为每一个 token 都会增加账单成本。
AI 模型市场已经非常拥挤。GPT-5.6 Luna、Grok 4.6 以及各种开源权重(open-weight)模型都在争夺“廉价 agent”这一细分市场。通过提供半价优惠期,Google 希望在 1 月份价格恢复至每百万输入 token 1.50 美元和每百万输出 token 7.50 美元之前,将开发者锁定在其生态系统中。
开发者可能获得——或失去什么
- 在折扣期间提升利润率 – 将 token 成本减半,可以为任何每天处理数百万 token 的服务显著降低运营预算百分比。
- 潜在的锁定效应 – 更换供应商很少能做到“即插即用”。不同模型的 API 在请求格式、速率限制(rate limits)和支持的功能方面都存在差异。价格的突然跳升可能会迫使团队承担更高的成本,或者投入时间和金钱进行迁移。
- 竞争性的价格压力 – 竞争对手可能会通过自己的限时优惠做出回应,引发短期价格战,这虽然可能使最终用户受益,但也可能破坏长期的规划。
如何保护您的 agent 流水线
- 标记截止日期 – 为 12 月 31 日设置日历提醒。明确价格恢复的具体日期有助于避免利润率意外缩减。
- 设计可互换性 – 在一层薄薄的封装层或配置文件之后封装模型调用。例如,如果您将 Gemini 换成 Luna,应该只需要更改配置,而不是重写全部代码。
- 运行您自己的基准测试 – 使用实际任务将 Gemini 3.7 Flash 与其他模型进行比较。Token 成本只是方程的一部分;延迟、准确性和集成工作量同样重要。
这笔交易的另一面
该折扣明确是暂时的。在年底截止后,开发者将面临全额价格档位,这仍然高于某些开源权重项目所宣传的价格。已经与 Gemini 进行深度集成的团队可能会比那些保持架构模块化的团队感受到更剧烈的价格跳升。如果模型在特定用例上的表现落后于更便宜的替代方案,那么低价格并不一定会自动转化为更好的整体价值。
下一步值得关注什么
- 1 月份的价格确认 – Google 已发出恢复原价的信号,但任何调整或延期都将影响预算周期。
- 竞争对手的促销活动 – 竞争对手的限时折扣可能会在新年之前改变成本计算。
- 采用指标 – 在折扣窗口期内 Gemini 3.7 Flash 的早期采用情况,将暗示一旦价格再次上涨,该平台的粘性如何。
核心观点: 半价优惠期为开发者提供了一个测试更快、更便宜的 agent 模型的机会,但真正的优势在于构建能够在折扣结束时进行切换的系统。现在的灵活性可以防止以后陷入昂贵的混乱。
