大模型API的”电费”终于要分时段收了。DeepSeek V4本周正式完成API全面切换,取代此前使用的V3版本,同时引入AI行业首个”峰谷定价”机制——高峰时段价格翻倍,低谷时段直降七成。这种借鉴电力行业定价逻辑的商业模式,正在改写大模型服务的成本结构。
峰谷定价:AI版的”错峰用电”
DeepSeek V4 Pro(总参数1.6万亿、激活参数49B)每百万输出Token的常规价格为0.87美元,高峰时段(每日9:00-12:00、14:00-18:00)翻倍至1.74美元。轻量级V4 Flash每百万输出Token常规价格仅0.28美元,高峰期0.56美元,缓存命中时输入费用低至0.0028美元。

这意味着什么?对于中小企业和独立开发者来说,如果把批量推理任务安排在凌晨或晚间低谷时段,成本可以降低70%以上。一位使用DeepSeek API的开发者在社交媒体上算了一笔账:他的月均API开支从4200元降到了1800元,仅仅是调整了任务调度时间。
这种定价策略并非简单的促销手段。大模型推理对GPU资源的占用是实时的、刚性的,白天工作时段的需求高峰会让算力供给极度紧张。通过价格杠杆引导用户错峰使用,既能平滑算力负载曲线,也能让低峰时段的闲置资源产生价值。这和大数据中心的容量管理思路一脉相承,只不过第一次被用在大模型API定价上。
V4到底强在哪
抛开价格策略,V4本身的能力升级才是开发者关注的核心。V4 Pro采用MoE(混合专家)架构,1.6万亿总参数中每次推理仅激活49B,兼顾了效果和效率。在代码生成、数学推理、多轮对话等关键场景上,V4 Pro的表现已经逼近Claude Fable 5和GPT-5.6级别,而价格只有后者的五分之一到十分之一。

更关键的是V4 Flash。这款轻量模型专为高频调用场景设计,响应速度和成本都做到了极致。对于需要大量调用API的应用——比如实时翻译、客服机器人、内容审核——V4 Flash的性价比几乎没有对手。
一位从事跨境电商的开发者反馈,他把商品描述翻译的API从GPT-4.1切换到V4 Flash后,单条翻译成本从0.12元降到了0.02元,质量损失几乎不可感知。”省下来的钱直接多开了两条业务线。”
行业连锁反应
DeepSeek的峰谷定价不是一次孤立的定价实验。几乎同一时间,阿里在WAIC 2026大会期间发布了Token Plan个人版,Qwen3.8-Max预览版同步上线,进一步拉低了国产大模型的使用门槛。月之暗面的Kimi K3虽然因算力紧缺暂停了C端新用户订阅,但其2.8万亿参数的开源模型在开发者社区的调用量持续攀升。

大模型市场正在经历从”谁更强”到”谁更划算”的转变。当模型能力差距缩小到难以感知的程度,定价策略和服务稳定性就成了开发者选择的关键因素。Anthropic上周发布的Claude Opus 5也走了类似路线——性能追平旗舰Fable 5,API价格直接砍半,输入5美元/百万Token、输出25美元/百万Token。
可以预见,未来半年大模型API的价格战会更加激烈。对于依赖AI能力构建产品的团队来说,多模型混用、按场景选模型、按时段调任务,会成为标配的成本优化策略。DeepSeek的峰谷定价,可能只是这场效率革命的起点。




