DeepSeek 在 8 月 12 日深夜上线的 V4 Pro 正式版把 Agent(能自主完成多步任务的 AI)跑分做到了接近甚至部分反超国际头部对手 Fable 5 的水平,API(开发者调用的付费接口)价格仍只有对手约十分之一——这是中国大模型公司第一次在 Agent 维度上明显缩短与国际第一梯队的距离。
模型支持 100 万 Token(约 70 万中文字)上下文输入、38.4 万 Token 输出,覆盖 Thinking、Tool Calls、Responses API 等能力。第三方平台实测显示,V4 Pro 已能自主完成"分析 7000 条电商数据并生成可交互 Dashboard 网页""把《奥德赛》做成互动故事网站""从零搭建带引力物理模拟的宇宙沙盒"三类典型任务,中间步骤基本不需人插手。
这是什么
DeepSeek V4 Pro 是 V4 系列的正式旗舰版本,前作 V4 Flash 在 7 月底已上线。核心升级集中在 Agent 能力:Terminal Bench、DeepSWE 等 Agent 评测中,V4 Pro 多项指标逼近头部对手 Fable 5,两项实现反超。
价格方面,官方文档显示 8 月 17 日起改用峰谷定价:非高峰时段输入 4.5 元/百万 tokens、输出 13.5 元/百万 tokens;高峰时段翻倍。即便按高峰计算,输入也只有 Fable 5 的约 1/8、输出约 1/13。
一个隐含短板是:V4 Pro 缺乏多模态(图文、视频等多类型内容的理解与生成)能力,生成网页的视觉设计仍需要外部图像模型补齐——它能"干活",但还不能独立"做好看"。
行业怎么看
正面声音集中在性价比。多家工具方反馈,V4 Pro 在数据分析、内容理解、Coding 三类任务上已能"自己把中间步骤补齐,一路做到最终成果",对中小企业是显著的降本工具。
但保留意见同样值得记录。第一,模型并非"完全不用管",视觉与交互细节仍需人反复调整;第二,DeepSeek 此轮价格实际在涨,从统一价改为峰谷价,高峰时段翻倍,重度使用者成本可能上升;第三,本次实测来自推广自家接入产品的第三方平台,测评中立性需打折扣;第四,Agent 跑分追平并不等于真实任务体验追平,榜单与生产环境表现常有落差。
对普通人的影响
对企业 IT:性价比窗口正在打开。原来动辄十几元一次的智能体任务,现在几毛钱即可,企业把数据分析和报表流程外包给 AI 的成本门槛大幅降低。
对个人职场:不会写代码的职场人也能让 AI 跑完多步任务,但"自己做完"和"做出能交差的成品"之间仍有距离,审美与交互判断仍需人来把关。
对消费市场:价格战最终会传导到面向消费者(C 端)的 AI 工具功能升级,但当前个人付费意愿仍在培育期,多数人还在用免费版"试试看"。