使用“扫一扫”即可将网页分享至朋友圈。
美国芯片断供高端GPU芯片,高性能芯片国产替代正当时
事件:集微网新闻报道,美国芯片厂AMD英伟达相继收到总部通知,对中国区客户断供高端GPU芯片
1. 我们向英伟达和AMD的中国代理商验证,得到回复还没有收到official notice,他们也是看新闻才知道
2. 新闻涉及的AMD的MI100和MI200,NVDA的A100和H100是高端型号,针对企业客户,数据中心应用,同性能目前国产没有替代的
3. 从限制14nm以下的半导体设备,到限制3nm以下EDA,再到美国芯片法案签署,新的国际环境下,高性能芯片自主可控愈发迫切,相关高性能芯片产业链国产上市公司值得关注:
CPU:海光信息、龙芯中科
GPU/加速卡:景嘉微、寒武纪
FPGA:复旦微电(新产品有大突破,感兴趣私信)、紫光国微、安路科技
服务器存储:澜起科技、聚辰股份
EDA/IP:华大九天、芯原股份、概伦电子、广立微
美国芯片厂商AMD、Nvidia相继收到美国总部通知,对中国区客户断供【高端】GPU芯片。
AMD通知内容为:1)暂停对中国区所有数据中心GPU卡MI 100和MI 200发货;2)统计中国区MI 100已发货量;3)统计中国区MI 200已发货客户清单和发货明细。
Nvidia通知内容为:1)暂停对中国区所有客户所有代理商的数据中心GPU卡A100和H100的发货,其他GPU卡不受影响;2)各服务器OEM厂商的下游库存A100 GPU卡,目前可以对各自的行业客户继续交付,Nvidia中国区目前没有对OEM厂商发任何书面通知。
---------------
1、如果以上消息属实,1)Nvidia和AMD对中国断供的是:高端GPU芯片。并不是所有的GPU芯片都断供。这个与前几周美国对GAA的EDA工具进行对中国提供是一样的思路:美国是对最先进制程、最强算力芯片、最新高端芯片等对中国进行限制。2)MI 100和MI 200是AMD这两年发布的最新高性能GPU芯片。MI 100于2020年11月发布,发布之时,MI 100号称是全球最强算力GPU芯片,主要用于:处理高性能计算(HPC)和人工智能任务;MI 200于2021年11月发布,性能也是非常强大。3)目前中国还没有与之直接的竞品。
2、从这几款芯片的介绍,我们可以看出,1)无论是 AMD的MI 100、MI 200还是Nvidia的A100,H100,都是GPU领域的超强算力芯片。2)GPU芯片一般是应用在服务器中,用于加速计算。一般是服务器厂商采购或者服务器下游客户直接采购GPU芯片。3)这四款芯片的应用领域主要是在:第一,HPC高性能计算,主要是科学研发领域;第二,人工智能场景,特别是对算力要求的比较高Training(训练)环节。
为了对此次被限制的产品有个大致的概念,我们可以看下Nvidia的GPU产品线,被限制的A100大概处在什么位置。
GPU断供型号梳理
总结来看,本次美国宣布对中国断供GPU的几个关键信息:1)应用领域:数据中心高端GPU;2)涉及厂商:AMD、NVIDIA两大龙头;3)产品型号:AMD旗下MI100和MI200系列、NVIDIA旗下A100和H100系列;4)断供节奏:暂停发货并统计已发货清单,预计2-3天后会发布对客户与合作伙伴的沟通口径。
具体断供产品介绍如下:
1)AMD MI100(全称AMD Instinct MI100加速器)
产品简介:AMD MI100发布于2020年11月16日,主要应用领域包括人工智能、离子物理研究、星系模拟等。
架构设计:采用AMD CDNA的GPU设计架构,拥有120 个计算单元(7,680个核心),核心频率1502 MHz。
工艺制程:采用台积电7nm FinFET技术。
计算性能:峰值双精度(FP64)性能11.5 TFLOPS、峰值单精度(FP32)性能23.1 TFLOPs、峰值半精度(FP16)性能184.6 TFLOPs、bfloat16峰值性能92.3 TFLOPs、矩阵峰值性能46.1 TFLOPs FP32。
GPU内存:显存32 GB、显存时钟频率1.2GHz、显存带宽1228.8GB/s。
功耗(TDP):300W
2)AMD MI200(全称AMD Instinct MI200系列加速器)
产品简介:AMD Instinct MI200系列加速器是 AMD 最新推出的数据中心GPU,应用于百亿亿级超级计算系统在内的主流服务器和超级计算机加速,帮助科学家应对从气候变化到疫苗研究等带来的计算需求。MI200系列包括三个细分型号:MI210(发布于2022年3月22日)、MI250(发布于2021年8月11日)、MI250X(发布于2021年8月11日)。以下参数介绍以MI250X为例。
架构设计:采用AMD CDNA2的GPU设计架构,拥有220个计算单元(14,080个核心),核心频率1700 MHz。
工艺制程:采用台积电6nm FinFET技术。
计算性能:峰值双精度(FP64)性能47.9 TFLOPS、峰值单精度(FP32)性能47.9 TFLOPs、峰值半精度(FP16)性能383 TFLOPs、INT8 计算性383 TOPs、矩阵峰值性能95.7 TFLOPs FP64。
GPU内存:显存128 GB、显存时钟频率1.6GHz、显存带宽3276.8 GB/s。
功耗(TDP):560W
3)NVIDIA A100(全称NVIDIA A100 Tensor Core GPU)
产品简介:NVIDIA A100 Tensor Core GPU发布于2020年11月16日,可针对AI、数据分析和HPC应用场景,助力更高性能的弹性数据中心。A100可划分为七个 GPU 实例,以根据变化的需求进行动态调整,提供 40GB 和 80GB 显存两种版本。以下参数介绍以80GB版本为例。
架构设计:采用NVIDIA Ampere架构,拥有6912 个 CUDA 内核,核心频率1410 MHz。
工艺制程:采用台积电7nm工艺。
计算性能:峰值双精度(FP64)性能9.7 TFLOPS、峰值单精度(FP32)性能19.5TFLOPs、峰值半精度(FP16)性能624 TFLOPs、INT8 计算性1248 TOPs、bfloat16峰值性能624 TFLOPs。
GPU内存:显存80 GB、显存带宽2093 GB/s。
功耗(TDP):400W
4)NVIDIA H100(全称NVIDIA H100 Tensor Core GPU)
产品简介:NVIDIA H100 Tensor Core GPU发布于2022年3月22日,在数据中心级部署H100GPU可提供出色的性能,并使所有研究人员均能轻松使用新一代百亿亿次级(Exascale)高性能计算(HPC)和万亿参数的AI。H100提供H100 SXM和H100 PCIe两个版本,以下参数介绍以H100 SXM为例。
架构设计:采用NVIDIA Hopper架构,拥有18432个 CUDA 内核,核心频率1.8GHz。
工艺制程:定制版的台积电4nm工艺(4N)。
计算性能:峰值双精度(FP64)性能30 TFLOPS、峰值单精度(FP32)性能60 TFLOPs、峰值半精度(FP16)性能2000 TFLOPs、INT8 计算性4000 TOPs、bfloat16峰值性能2000 TFLOPs。
GPU内存:显存80 GB、显存带宽3TB/s。
功耗(TDP):700W
3、关于全球GPU竞争格局
21Q1:Nvidia(81%),AMD(19%)
21Q2:Nvidia(83%),AMD(17%)
21Q3:Nvidia(83%),AMD(17%)
21Q4:Nvidia(81%),AMD(19%)
22Q1:Nvidia(75%),AMD(24%)
“比特财经”的新闻页面文章、图片、音频、视频等稿件均为自媒体人、第三方机构发布或转载。如稿件涉及版权等问题,请与
我们联系删除或处理,客服邮箱:bitokx@163.com,稿件内容仅为传递更多信息之目的,不代表本网观点,亦不代表本网站赞同
其观点或证实其内容的真实性。
