2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡
最新9月6日消息,OpenAI发布的GPT-6 Astra大模型这两天还在刷屏,它是该公司首个使用10万卡训练的大模型,光这些显卡的费用就要60亿美元了,这也是国产大模型很难追赶的领域。
国内大模型发展最大的限制就是缺少足够的算力芯片,国内当然也在高强度发展自己的AI芯片,不论是华为、寒武纪、壁仞、摩尔线程还是百度、阿里、字节、腾讯等公司都在研发各种AI芯片。
但是大家也要面对现实,国产AI芯片在性能上跟美国的AI芯片差距还是不小的,下图汇总的国内外AI芯片算力性能对比可见一斑。

这张图对比了AI芯片的内存带宽及FP16算力性能2个指标,这都是AI大模型训练、推理的核心指标,国产中做得最好的还是华为的昇腾,性能追到了780TFLOPS,带宽能到780GB/s,带宽性能超过了H100,算力性能还差距比较大。
说得更直白一点,国产AI芯片现在连3年前的NVIDIA H200显卡的性能都很难追上,后者1700TFLOPS的性能、900GB/s的带宽放到现在都不弱。
当然,这张图里面的对比数据不算新了,华为已经有比昇腾910C更强的昇腾950了,用了自研的高性能内存,带宽也做到4TB/s了,整体性能虽然还是比H200差一些,但差距没有现在这样的代差了。
其他公司如寒武纪、摩尔线程、沐曦、壁仞等自研的AI芯片新一代产品的性能也大幅提升,前途还是很光明的。
国产AI现在被卡脖子的地方也就是上面2个关键指标——算力意味着先进工艺,带宽意味着内存,尤其是HBM内存,工艺及内存的产能不能大规模释放出来,国产AI芯片追赶NVIDIA的速度就会被拖累,不仅没法缩小差距,可能还会被现在的B200、B300及Rubin Ultra显卡甩开,生态就更难建立起来了。

往好的方面来看,这两个难题的解决速度比大家想象中的更快,先进工艺有了华为韬定律给出了新的方向,密度及性能大幅提升,明年的鲲鹏960 CPU、昇腾960 AI性能会有一波强力拉升,这个领域的突破值得关注。

《2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
大模型算力体系需要怎样的存储!长江存储PE511 12.8TB企业级SSD评测:稳态4K随机写入超1000K IOPS
一、前言在今年3月CFMS闪存峰会上,长江存储同时发布了三款由晶栈Xtacking 4.0技术打造的企业级SSD产品—超大容量QLC的PE501、定位于高性能与高安全的通用主力型PE511,以及主打AI极致... -
4899元 台电推出极光8TB SATA固态硬盘:速率可达550MB/s
快科技9月7日消息,台电推出极光系列8TB SATA固态硬盘,主打广泛兼容性与大容量存储,顺序读取速度最高可达550MB/s,售价为4899元。该硬盘外壳采用极光纹理刻蚀工艺,搭配喷砂表面处理,质感... -
晶存科技发布96GB LPDDR5X LPCAMM2内存模组:传输速率达9600MT/s
快科技9月7日消息,晶存科技发布了一款单条容量达96GB、传输速率高达9600MT/s的LPDDR5X LPCAMM2 内存模组,以“双96”为核心亮点,进一步拓展了其在高性能AI PC领域的内存产品布局。... -
老板亏麻了!车库翻出30条前公司当垃圾处理内存:总价超7.1万元
快科技9月7日消息,近日一位Reddit网友发帖分享自己的捡漏经历,他在自家车库的角落里翻出了30条单条容量为64GB的DDR4内存条,总价值估算高达1万美元(约人民币7.1万元)。据该网友介绍,这些... -
HBM4让三星内存、代工业务双双翻身:贡献4nm工艺50%订单
快科技9月7日消息,HBM内存现在已经成为比GPU还要抢手的AI核心芯片,SK海力士之前超越三星成为内存一哥就是靠HBM先发优势,然而现在三星靠HBM4赶超回来了,并且有意外收获。据韩国媒体报道,三...












