深度求索订购 16 万颗华为昇腾 950DT,单一数据中心撑起 160 EFLOPS 推理
据彭博社报道,深度求索为内蒙古一座数据中心订购 16 万颗华为昇腾 950DT 加速器,用于大规模推理。单芯片 144GB 自研 HBM、FP8 算力约 1 PFLOPS,全网可达 160 EFLOPS。
作者:核流编辑 · 栏目:硬件
中国 AI 实验室正在加速把订单转向国产算力。据彭博社报道,头部 AI 实验室深度求索(DeepSeek)订购了 16 万颗华为昇腾 950DT 加速器,全部用于一座数据中心的推理业务。华为在去年就曾预告会推出一系列面向国内 AI 需求的芯片与机架级方案,这笔大额订单让规划开始变成现实。订单规模、芯片规格和部署位置三个信息放在一起,才能看清这笔采购对推理基础设施的含义。 昇腾 950DT:自研 HBM 与近 4TB/s 带宽 昇腾 950DT 采用华为自研 HBM 内存方案,单颗芯片配备 144GB 显存,带宽接近 4TB/s。算力方面,这颗芯片的 FP8 峰值约为 1 PFLOPS,切换到 FP4 精度可达约 2 PFLOPS。芯片之间通过新的灵衢互联协议与光链路组网,为连接数十万颗加速器设计。华为的 Atlas 950 SuperPoD 单机柜可容纳 8192 颗芯片,理论上可扩展到 64 个 SuperPoD、总计约 52.4 万颗加速器。 指标数值 单芯片显存144GB(自研 HBM) 显存带宽接近 4TB/s FP8 / FP4 峰值算力约 1 / 2 PFLOPS 单 SuperPoD 容量8192 颗加速器 单数据中心 160 EFLOPS 的推理集群 这批 16 万颗加速器将集中部署在内蒙古的一座数据中心,服务于深度求索的大规模推理业务。整机系统按 FP8 计算可达 160 EFLOPS 峰值,FP4 精度下约 320 EFLOPS;全网 HBM 总容量约 23PB。按这一体量,推理服务可以同时支撑数千名客户并发调用,华为宣称的理论扩展上限在这一订单规模下不会构成瓶颈。 对国产算力生态而言,这笔订单的信号意义在于:AI 实验室的大规模推理需求开始由国产加速器承接,且规模达到单一数据中心数十 EFLOPS 量级。订单细节来自彭博社的报道,华为与深度求索官方均未发布确认公告。 参考资料 TechPowerUp:Huawei Prepares 160,000 Ascend 950DT Accelerators for DeepSeek Data Center