DeepSeek V4-Flash正式版上线:Agent能力暴涨6倍,API价格仅为Claude的1/90

AI资讯1天前发布 EdgeClaw
1 00

8月1日,DeepSeek悄然上线V4-Flash正式版API,在不改变模型架构的前提下,仅通过后训练优化就实现了Agent能力的跨越式提升。数据显示,该模型在DeepSWE编程基准上从预览版的7.3分飙升至54.4分,涨幅超过6倍;在Terminal Bench 2.1评测中达到82.7分,直逼Claude Opus 4.8的85.0分。

DeepSeek V4-Flash MoE架构稀疏激活示意图展示模型高效推理机制

V4-Flash延续了2840亿总参数的MoE架构设计,实际推理时仅激活130亿参数,同时支持100万token的超长上下文窗口。这种”大骨架、小激活”的策略让模型在保持高性能的同时大幅压低了推理成本——缓存命中价低至0.2元/百万tokens,约为Claude同级能力的1/90。

开发者社区对这次更新的评价颇为积极。业内普遍认为,V4-Flash证明了”不改架构、只炼后训”的边际收益远被低估。在自主编程、运维智能体等场景中,这种低成本高性能的组合将显著降低落地门槛,让更多中小企业有能力部署AI Agent。

大模型API定价对比可视化展示DeepSeek与竞品的成本差异优势

值得一提的是,DeepSeek此次更新的时间节点颇具意味。同一天,OpenAI宣布了GPT-5.6系列大降价,Anthropic也确认了新的定价策略。大模型市场的价格战已从”谁更便宜”演变为”谁的性价比更高”——不仅是绝对价格,还包括同等价格下的实际任务完成质量。

从产业影响来看,V4-Flash的上线可能加速AI Agent从”demo展示”走向”生产部署”的进程。当编程Agent的成本降至Claude的1/90,企业IT运维、自动化测试、代码审查等场景的商业模型将发生根本性变化。有分析师预测,2026年下半年将出现一批基于低成本Agent的新型SaaS产品。

对于开发者而言,V4-Flash的100万token上下文窗口也是一个重要利好。这意味着可以一次性传入整个代码仓库的上下文,让Agent在更完整的信息基础上做出决策,减少因上下文截断导致的错误。目前,V4-Flash已通过DeepSeek官方API开放使用。

© 版权声明

相关文章