8月13日晚,DeepSeek悄悄把V4 Pro从预览版推上了正式版。没有发布会,没有预热,API文档里模型版本号直接更新为DeepSeek-V4-Pro-0813——老用户调用参数不用改一行,后端已经换了新引擎。
这一次更新的含金量,比很多人预想的要高。
Agent能力成最大卖点
V4 Pro正式版最核心的升级在于智能体能力。官方数据显示,新版在Terminal Bench 2.1(终端操作基准测试)中拿到87.9分,距离Anthropic旗舰Fable 5的88分只差0.1分;在CyberGym网络安全测试中甚至直接反超了Fable 5。

知名半导体分析机构SemiAnalysis在测试结果出炉后发文称,V4 Pro在Agent任务上”大幅击败NVIDIA的Nemotron 3 Ultra”。值得注意的是,激活参数更少的V4-Flash同样大幅领先Nemotron 3 Ultra,说明DeepSeek在Agent方向上的优化不是靠堆参数,而是架构层面的改进。
具体跑分方面,DeepSeek V4 Pro在多个Agent相关基准上表现突出:DeepSWE软件工程得分62.7(预览版仅12.8,翻了近5倍),NL2Repo代码工程61.5,Toolathlon工具调用74.1。这些数字指向一个趋势——大模型竞争的焦点正从”谁聊天更聪明”转向”谁能真正干活”。
原生支持Responses API,一键接入Codex
另一个关键更新是API协议的扩展。V4 Pro正式版原生支持OpenAI Responses API格式,并针对性适配了OpenAI Codex。这意味着开发者可以通过一键配置脚本,直接把DeepSeek V4 Pro接入Codex工作流,不再需要自己写协议转换层。

此前只有V4-Flash支持Responses API和Codex集成,Pro版正式补齐了这块短板。配合1M上下文窗口和384K最大输出,V4 Pro在处理大型代码仓库、长文档分析和多步骤Agent任务时有了更充裕的弹药。
同时,V4 Pro和V4-Flash的思考模式新增了low/high/max三档强度控制——简单任务用low省token,日常Agent任务用high,复杂推理场景切max。这种灵活度在同类模型中还不多见。
价格:当前是白菜价,但8月17日后要涨
V4 Pro的定价策略分两个阶段看。当前(8月17日前)的价格:缓存命中输入0.025元/百万tokens,缓存未命中输入3元,输出6元。横向对比——Fable 5输出360元/百万tokens,V4 Pro只要它的六十分之一;Opus 5输出约180元,V4 Pro是三十分之一。

但DeepSeek已经预告,8月17日起将实行峰谷定价。高峰时段(9:00-12:00、14:00-18:00)价格大幅上调:输入缓存命中涨到0.3元(涨幅11倍),未命中涨到9元,输出涨到27元。空闲时段则为高峰期的一半。
换句话说,现在的价格更像是一个”窗口期”。对于已经跑通业务逻辑的开发者,趁这段时间锁定用量和成本是明智的选择。
同晚竞品扎堆发布,AI军备竞赛加速
有意思的是,V4 Pro上线的同一晚,马斯克旗下xAI也发布了Grok 4.6,定价2美元/百万输入tokens和6美元/百万输出tokens,同样瞄准Agent和编程场景。几乎同时,阿里千问团队兑现开源承诺,开放了Qwen3.8-2.4T-A95B的模型权重——这是千问首次将Max级别旗舰模型对外开放。
一个晚上三个重磅更新,折射出当前大模型市场的竞争烈度。Agent能力已经成为各家布局的核心战场,谁的模型能更低成本、更高可靠性地完成真实世界的复杂任务,谁就能拿下开发者市场。
DeepSeek V4 Pro用价格证明了自己依然是”性价比之王”,但8月17日涨价后,这张王牌还能打多久,取决于正式版的实际表现能否让开发者觉得”贵也值”。








