Google DeepMind 这周把 Gemini 拉到 3.7 Flash 版本——这不是技术跃迁,而是价格战的延续。我们的判断是:Google 在用「便宜」而非「最强」,去抢被 OpenAI 和 Anthropic 蚕食的中小客户。
这是什么
Flash 是 Gemini 家族里的「中端走量款」,定位介于旗舰 Pro 和最小 Nano 之间。从 2.5 Flash 到 3.5 Flash 再到 3.7 Flash,Google 选择小数点迭代而非整代跳跃,意味着这次升级重点是「微调」而非「重写」。
对开发者来说,Flash 系列的吸引力从来不是「最强」,而是「每美元能买到的 token 数(模型处理文字的最小单位,按量计费)」。3.7 版本大概率延续这条路线——更快、更便宜、上下文窗口(模型一次能处理的最大文字量)可能更长。值得注意的是,Google 没有公布与上一代的详细 benchmark(模型跑分)对比,这本身就值得琢磨。
行业怎么看
支持方认为,AI 真正的爆发不在 ChatGPT 这种消费端应用,而在企业后台。一个能稳定接住客服、文档处理、数据提取的便宜模型,比一个偶尔惊艳的贵模型更值钱。Google 这次发新版,时机正好赶上越来越多企业从「试点」走向「全量上线」。
但反对声音也清晰:分析师指出,Flash 这类模型在多步推理(让模型一步步思考复杂问题)、长链 Agent 任务(让 AI 自主完成多步操作)上仍有明显短板。把简单任务便宜化是好事,但企业真正愿意付高价的复杂场景,Flash 撑不起来。另一层隐忧是:当所有厂商都在卷 Flash 时,价格战的天花板已经肉眼可见,差异化越来越难做。
对普通人的影响
对企业 IT:API(调用 AI 的付费接口)成本进一步下降,原本算不过账的客服自动化、营销文案批量生成、内部知识库检索等场景,现在可以认真立项了。
对个人职场:会用 AI 写脚本、做自动化的「技术型白领」议价能力上升;但单纯「会调提示词」的岗位溢价在快速消失——因为工具本身已经白菜化。
对消费市场:嵌入 AI 功能的 SaaS(在线软件服务)产品不会因此降价,但可能在不涨价的情况下塞进更多功能,用户感知最直接的是「反应变快」。