这是什么

8 月 17 日零时,DeepSeek 新定价生效。变化最大的不是「贵了」本身,而是贵的方式 — 它精准砍在高频缓存命中场景的命门上。

具体看:V4-Pro 高峰时段(北京时间 9-12 点、14-18 点)的缓存命中从 0.025 元/百万 tokens 跳到 0.30 元,翻 12 倍;V4-Flash 缓存命中高峰涨 5 倍;输出端普遍涨 2.25 倍以上。唯一温和的是输入未命中,只涨 1.5 倍。

值得关心的是:缓存命中这一档,原本是 DeepSeek 对高频调用方最明显的让利 — RAG(检索增强生成,即每次回答前先查知识库)、Agent(能自主规划步骤、循环调用工具的 AI 助手)、长上下文复用,几乎都靠它压成本。这次涨价,等于把这部分让利收回大半。

行业怎么看

第一类声音来自开发者社区。有技术作者实测:一个 RAG 项目原本靠缓存命中把单次问答压到几分钱,改完后高峰时段单次涨到 2 厘多,「几万次调用差距就出来了」。这类声音普遍务实:拆分 prompt 静态段、批量任务挪夜间、按任务分级用模型、压缩输出 — 没有抱怨,全是工程方案。

另一类声音则没那么乐观。有从业者指出,新表没标并发上限(旧版 Flash 是 2500、Pro 是 500),「如果涨价 + 压并发一起来,白天批量就是双重挨刀」。单看账单变贵是小事,调用能力被掐才是真风险。

更深一层判断:此举意味着中国大模型 API 进入「补贴退坡」周期。拼 token 单价不再是核心竞争力,拼调用结构、命中率、任务分级才是真本事。对完全依赖 DeepSeek、没做备选方案的企业,这是一次被动的架构升级测试。

对普通人的影响

对企业 IT:如果公司已跑 AI 问答、知识检索、智能客服这类高频场景,账单结构会立刻变化。建议让工程团队先拉出近一周日志,看缓存命中占比和高峰时段占比,再决定是否调整调度。

对个人职场:对非技术白领直接影响有限。但若工作流深度依赖 DeepSeek 做长文档处理、自动生成、邮件草拟,建议自己记录月度账单 — 单次差异不大,累积下来未必仍是「免费午餐」。

对消费市场:消费者暂时无感,调价针对 B 端 API。但信号值得留意:头部模型公司敢涨价,往往意味着算力吃紧、补贴收缩。AI 服务的边际成本曲线,正在悄悄改变。