8月6日,国产大模型DeepSeek发布了一则简短公告:计划近期整体上调API服务定价,预计涨幅较大。短短一句话,在开发者社区激起巨大反响。作为曾经将API价格打到行业地板价的价格屠夫,DeepSeek的这次转向被外界视为国产大模型行业全面涨价的标志性信号。
四个月三轮调价,降价红利迅速消退
回看过去四个月,DeepSeek的定价策略经历了三次明显变动。2026年5月,V4 Pro永久降价75%,输出价格从24元/百万Token降至6元,开发者一片叫好。6月底引入峰谷计费,工作日高峰时段价格翻倍。7月底老模型ID下线,用户被迫迁移到新版本。如今8月再宣布整体上调,降价带来的甜头仅维持了四个月。
当前价格方面,DeepSeek-V4-Flash缓存命中输入0.02元/百万Token、未命中1元、输出2元;V4-Pro对应分别为0.025元、3元和6元。具体新价格方案尚未公布,但整体上调和涨幅较大的措辞,意味着此前的低价策略将彻底改变。
调用量暴增背后的算力困局
涨价的直接推手是需求与成本的双重挤压。据OpenRouter数据,8月3日至7日当周,DeepSeek-V4-Flash调用量达到11.31万亿Token。另一平台OpenCode的数据显示,仅8月1日一天,V4-Flash的Token处理量就冲到8万亿,其中5万亿来自免费额度。
调用量暴增的背后是智能体应用的大规模落地。单次Agent任务的算力消耗可达普通对话的百倍,当海量用户涌入、高并发请求激增,算力挤兑直接导致服务稳定性下降。与此同时,高端AI芯片产能受限、供应链成本持续走高,单纯靠低价换规模的模式已经难以为继。

行业转向:从价格战到价值回归
DeepSeek的涨价并非个例。2026年以来,腾讯云在不到一个月内连续两次上调云计算服务价格,算力资源全面趋紧。整个行业正从亏本赚吆喝的激进价格战,转向成本控制与可持续盈利。
对于开发者来说,这意味着需要重新评估API调用成本。几个实用建议:优化Prompt长度以减少Token消耗;在非高峰时段调用API降低成本;建立本地缓存机制避免重复请求;对于高频但简单的任务考虑使用更轻量的模型版本。
大模型商业化的必经之路
从更长远的视角看,涨价是大模型商业化走向成熟的必答题。大模型并非一次训练完成后就能低成本无限复制,用户的每一次调用都在消耗GPU算力、电力、网络和集群运维资源。当日均Token调用量从2024年初的1000亿增长到2026年的140万亿,两年增长超千倍,任何企业都无法长期承受这种成本压力。
AI算力的低价红利时代已经结束,行业正在回归合理定价。对开发者和企业用户来说,与其抱怨涨价,不如尽早建立成本优化策略,在效率与投入之间找到平衡点。








