
至少16万颗昇腾:DeepSeek先把推理搬进内蒙古
Bloomberg 披露 DeepSeek 计划在内蒙古约 1GW 数据中心部署至少 16 万颗华为 Ascend 950DT,本文拆解推理与训练分工、华为产能瓶颈,以及这笔订单距离实际交付还有多远。
作者丨 AI 科技评论
编辑丨 AI 科技评论
过去两年,全球 AI 公司争抢的核心资源,已经从模型参数扩展到电力、机房和加速器。
OpenAI、Anthropic 等美国公司,已经把数十亿美元甚至更大规模的资金投入 AI 算力基础设施。
DeepSeek 现在也在内蒙古乌兰察布规划一座约 1GW 的数据中心。
问题在于,这座机房里究竟装什么芯片。
9 月 4 日,Bloomberg 作者 Mackenzie Hawkins 和 Haze Fan 报道,DeepSeek 计划采购至少 16 万颗华为 Ascend 950DT,用于运行模型。报道的发布时间是北京时间 9 月 4 日 17:08。1
这笔计划把中国 AI 的国产替代推进到了一个更具体的尺度:训练环节仍依赖 Nvidia,日常推理则准备交给华为。
原文定位
推荐阅读的是 Bloomberg 于 2026 年 9 月 4 日发表的原报道《DeepSeek Plans Big Huawei AI Chip Order to Power New Data Center》。
两位作者引用了熟悉这笔机密交易的人士,并明确保留了匿名信源的限制。1
DeepSeek 和华为都没有在 Bloomberg 发稿前回应置评请求。
因此,原报道呈现的是一项正在推进的采购与部署计划,读者需要把“计划采购”“预计部署”和“已经交付”分开看。
01|16 万颗先看用途
Bloomberg 给出的核心数字是至少 16 万颗 Ascend 950DT。
这批芯片计划部署在 DeepSeek 位于内蒙古乌兰察布的数据中心,整座设施的算力基础设施规划约为 1GW。1
1GW 说的是园区级电力和算力建设规模。
它不是 16 万颗芯片的直接换算结果。
Bloomberg 还特别写明,16 万颗 Ascend 950DT 只会占这座数据中心总容量的一部分,剩余容量准备使用什么芯片,原报道没有给出答案。1
这也是这条新闻最容易被读错的地方。
至少 16 万颗,是采购和部署计划中的下限。
这个数字还没有变成已安装的芯片数量。
乌兰察布项目此前已经由 Bloomberg 报道过:DeepSeek 计划自建数据中心,同时租用其他公司的算力,并争取在 2027 年底或 2028 年初让至少一部分容量上线。2
因此,本次报道增加的是“芯片方案”,而不是一座已经满载运行的数据中心。
AI 科技评论注意到,DeepSeek 把一笔巨大的芯片计划放进了一个更大的园区建设周期里。
这是一张未来算力配置表,暂时还是一份交付待验证的订单。
02|训练和推理分开
理解这笔订单,要先分清训练和推理。
训练是用大量数据更新模型参数的过程。
推理是模型完成训练后,响应用户请求、生成答案和调用工具的过程。
两类工作都需要加速器,但训练更依赖大规模并行计算、芯片之间的高速通信和软件栈稳定性。
推理则更接近日常服务:模型已经完成训练,数据中心需要同时处理大量用户请求。
Bloomberg 报道称,DeepSeek 当前计划用 Ascend 950DT 运行模型,也就是把这批芯片放在推理环节。
同一报道还称,DeepSeek 暂时没有计划用 950DT 训练模型;此前 DeepSeek 曾尝试用华为芯片训练模型,但关键训练环节目前仍依赖 Nvidia 加速器。1
华为自己的产品规划也能解释这种分工。
华为轮值董事长徐直军在 2025 年 9 月的 Huawei Connect 演讲中,将 Ascend 950DT 定位为同时面向推理 decode 阶段和模型训练的芯片,并计划在 2026 年第四季度上市。3
换句话说,华为把 950DT 设计成了能承担训练的产品。
DeepSeek 的当前安排,却先把它放在模型运行这一侧。
东京新闻 9 月 4 日刊发的共同通信稿件,也复述了这一边界:至少 16 万颗 950DT 计划用于内蒙古数据中心,训练环节仍高度依赖 Nvidia。4
这条日文二次报道可以补充确认“推理使用华为、训练仍靠 Nvidia”的转述范围。
它没有提供 Bloomberg 原文之外的订单合同、芯片交付或训练迁移证据。
国产芯片先接管推理,说明替代路线已经进入服务层;训练依赖仍然留在最重的那一段。
这种组合也更符合 DeepSeek 眼下的现实需求。
用户增长越快,在线调用越多,推理侧就越需要稳定、可持续扩容的芯片供应。
训练侧则要面对下一代模型的研发效率、软件适配和集群通信。
DeepSeek 目前选择把两条路线拆开,先解决一部分每天都会发生的请求。
03|华为产能才是硬门槛
这笔订单的最大约束,不是 DeepSeek 有没有采购意愿。
约束来自华为能在多长时间内交出多少颗 950DT。
Bloomberg 引述知情人士称,华为目前没有足够产能快速满足 DeepSeek 的采购需求。
高端存储器等零部件短缺,会把 Ascend 950DT 今年的产量限制在数十万颗的较低区间。
华为还要同时满足其他客户的需求,并尝试向海外市场供应少量芯片。
因此,完成 DeepSeek 这笔订单可能需要一年以上。1
华为官方产品路线也给出了一个时间锚点:950DT 计划在 2026 年第四季度上市,Atlas 950 SuperPoD 同样计划在第四季度提供。后者单个超节点最多搭载 8192 颗 Ascend 950DT。3
单个超节点的产品规划,与 DeepSeek 的 16 万颗园区级计划,属于两个不同的尺度。
前者证明华为已经公开规划了大规模组网方式。
后者要求华为把产品发布、存储器供应、制造产能和多批次交付全部接上。
这中间隔着一条很长的生产线。
Bloomberg 还提到,华为去年预计在 2026 年生产约 160 万颗 Ascend 裸片,其中大部分将用于 910C 等其他型号;950DT 的供给因此不能直接从 Ascend 总裸片数字中推导出来。1
AI 科技评论在这里更关心“能否按时交货”,而不是“纸面上有多大规模”。
读者接下来可以盯住四个信号:
| 后续信号 | 它能验证什么 |
|---|---|
| 950DT 在 2026 年第四季度是否按计划上市 | 产品发布时间和供货起点能否兑现。3 |
| DeepSeek 是否公开采购、交付或安装进度 | “至少 16 万颗”是否从计划数字变成实际部署。1 |
| 乌兰察布数据中心是否在 2027 年底至 2028 年初出现分阶段上线信息 | 1GW 规划是否进入工程建设和运行阶段。2 |
| DeepSeek 下一代模型的训练硬件是否发生变化 | Nvidia 依赖是否从训练环节进一步下降。1 |
原报道的完整判断
Bloomberg 把这笔计划放进中美 AI 基础设施竞争中观察。
美国的 OpenAI 和 Anthropic 已经在大规模投入 AI 数据中心。
Bloomberg 7 月关于乌兰察布项目的报道提到,美国公司当时已经推进 3GW 和 5GW 级别的数据中心项目,中国的 1GW 规划仍然处于追赶位置。2
最新报道把比较进一步落到了芯片上。
Nvidia 仍然是全球训练和推理加速器的主流标准,但美国出口限制让中国公司获得先进 Nvidia 芯片变得更困难。
中国政府也在推动 AI 实验室转向国产硬件。
DeepSeek 因此向北京寻求帮助,希望华为更快、更大规模地分配芯片给自己。1
乌兰察布的地理条件也服务于这套基础设施规划。
当地位于北京西北约 350 公里,年平均气温约 4 摄氏度,较低温度有助于降低高功率服务器的散热能耗。
当这座数据中心满负荷运行时,1GW 的用电量大致相当于 75 万户家庭的用电规模。
这 16 万颗 950DT 只覆盖其中一部分容量。1
剩余容量的芯片来源,原报道仍然留在问号里。
美国政府官员声称 DeepSeek 已经获得 Nvidia Blackwell 芯片并安装在内蒙古,但 Bloomberg 明确表示尚未独立核实这项说法。1
这条信息应当停留在“美国官员的指控”层面。
原报道里的两句话
Bloomberg 对这笔计划的第一层概括是:
“DeepSeek plans to deploy at least 160,000 of Huawei Technologies Co.’s top accelerators at a massive data center it’s building in Inner Mongolia.” 1
关键词是 “plans to deploy” 和 “at least”。
前者表示计划部署,后者表示数量下限。
第二个关键词来自供货段落:
“fulfilling DeepSeek’s order could take more than a year” 1
订单规模已经摆出来了。
时间表还要等华为的产能回答。
DeepSeek 想把推理搬进内蒙古,华为得先把芯片送到那里。
References
- 1
- 2
- 3
- 4ファーウェイ半導体を採用 中国AIのディープシーク - 東京新聞デジタル
tokyo-np.co.jp
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
