DeepSeek被曝部署16万颗华为昇腾950DT:国产AI算力集群迈入十万卡时代

AI资讯2天前发布 EdgeClaw
3 00

16万颗华为AI芯片,正在把国产算力推入一个新量级。据彭博社9月4日援引知情人士消息,DeepSeek计划在内蒙古建设的大型数据中心内部署至少16万颗华为下一代昇腾950DT加速芯片,用于大模型推理。一旦落地,这将成为公开报道中已知规模最大的国产AI芯片单点集群。

消息发布后迅速引爆行业讨论。在当前美国对华高端芯片出口管制持续收紧的背景下,这笔订单传递的产业信号,远不止于一家企业的采购决策——它被普遍视为中国AI基础设施自主化进程进入新阶段的标志性事件。

16万颗昇腾950DT:国产算力的”超大规模”路线

DeepSeek此次选中的昇腾950DT,属于华为昇腾950系列。按照华为轮值董事长徐直军2025年9月在全联接大会上公布的规划,该芯片计划于2026年第四季度正式交付,更侧重推理解码和训练场景。针对数据读取和芯片间通信的高要求,950DT规划配备144GB内存,内存访问带宽达到4TB/s,互联带宽提升至2TB/s。

内蒙古超大规模AI数据中心服务器集群夜景,远处草原风电与星空辉映,国产算力蓄势

与芯片同步推出的还有Atlas 950超节点,最多支持8192张昇腾卡,通过华为自研”灵衢”互联技术实现芯片间高速数据交换。徐直军曾解释,超节点虽然在物理上由多台机器组成,但能像一台计算机一样完成学习、思考和推理。

值得关注的是,DeepSeek与华为的合作已延伸至算力系统设计层面:双方联合定义昇腾超节点,围绕长文本推理降低时延、提升吞吐并控制成本,同时兼顾向万卡级集群扩展的需求。华为长期奉行的”系统级工程”路线——用大规模集群互联弥补单卡性能差距——正在DeepSeek这个超大项目上得到集中验证。

训推分离:推理先行,训练仍靠英伟达

一个关键细节是:DeepSeek目前并不打算用950DT进行模型训练,尽管华为在设计和推广这款处理器时将其定位为能够胜任这一要求更高的任务。知情人士称,DeepSeek此前曾尝试使用华为芯片训练模型,但迄今在核心训练环节仍主要依赖英伟达加速芯片。

国产AI芯片微距特写,蓝紫辉光沿电路板纹路流动,光点粒子环绕,代表昇腾核心硬件

这清晰揭示了国产算力替代的现实节奏:推理负载对单卡极致算力的依赖度低于训练,且对延迟、吞吐和成本更敏感,更适合大规模国产芯片铺开;而大模型训练对显存容量、互联带宽、精度稳定性要求极高,仍是国产芯片需要持续攻坚的环节。”推理替代优先、训练逐步追赶”,正是中国AI产业在外部约束下做出的理性选择。

产能约束:需求旺盛与供给不足的突出矛盾

如此大规模的订单,能否按时交付是最大悬念。据知情人士透露,受高端存储芯片等关键元器件供应瓶颈制约,华为今年950DT的产量预计被限制在”数十万颗”级别的低端区间。换言之,DeepSeek一家的需求量,几乎与华为950DT全年的潜在产能相当,完成这笔订单可能需要一年以上。

华为还需要平衡其他客户的需求,并尝试向海外出口少量产品。DeepSeek甚至已向北京方面寻求协助,希望推动华为加快芯片交付和资源倾斜——这反映出当前国产AI芯片”需求旺盛与产能受限”之间的突出矛盾。

金色上升趋势箭头穿过蓝色数据柱状图与服务器轮廓,象征国产算力集群迈入十万卡时代

国产算力崛起的信号意义

DeepSeek的内蒙古项目并非孤例。今年3月,深圳投建的11000P智能算力集群正式点亮;6月,美团发布LongCat-2.0大模型,宣称已在五万卡国产算力集群上完成从零预训练到推理的全流程;7月,智谱被曝建成一座规划功率约1吉瓦、采用国产芯片的数据中心。

与这些项目相比,DeepSeek的16万颗规模直接把国产算力集群推入”十万卡时代”。项目整体规划达到吉瓦级,电力消耗预计可满足约75万户家庭的用电需求,选址内蒙古也贴合”东数西算”国家枢纽节点的整体布局。

在”算力即国力”逐渐成为行业共识的今天,谁能率先构建起自主可控、规模庞大的算力底座,谁就将在下一轮AI产业竞赛中占据先机。需要说明的是,截至发稿,华为与DeepSeek双方尚未对此消息发表官方确认,订单仍处于媒体报道阶段,最终落地情况值得持续关注。

© 版权声明

相关文章