看了DeepSeek梁文锋交流会发言,能看到目前一些现实的情况:
1.国产算力还是处于一个“遥遥落后”的地步,单卡性能大概就是NVIDIA最新芯片的百分之几。
2.美国的算力依旧是真正的“遥遥领先”,DeepSeek训练了1.6T大模型不是因为这么大就够用了,而是因为现有的资源只够训练这么大的模型,而且最主要的一点是,中国无法获取美国最先进的B300芯片,还是只能用最老的H100,H200,不过有总比没有好。
3.国产算力生态从“没法用”走向了“可以用”,注意还没有达到“好用”的阶段,因为买不到那么多的卡,所以“不得不”使用国产卡,构筑另外一个生态,当然,梁文锋也提到了,NVIDIA的卡绑定的cuda生态,其实是跟游戏卡也绑定的,但是现在的计算卡跟游戏卡其实已经天壤之别了,而且由于AI的加持,构建一个新的计算生态的难度是降低了的,只要买不到NVIDIA的卡,逼着大家都来用国产卡,那么这个生态是一定可以做出来的。
4.后续的DeepSeek大模型还是会提供原生多模态的能力,而且只会在一些领域持平美国最顶尖的大模型,不可能在全部的领域都超过美国的大模型,那不现实,就拿最近的Kimi来讲,也就是在编程方面能够追上顶尖的sota,但是其他能力方面还是会有问题。
5.DeepSeek自研芯片也是一个待考虑项,目前华为能供应950的大概是在15000卡左右,这是远远不够的,大概只能相当于NVIDIA最先进芯片能力的1/4,这一点从昇腾950超节点和NVL144超节点的对比就能看出来巨大的差距(我之前写过一篇文章分析,昇腾950的性能大概只有B300的8%左右,可以说是一道天堑),不过总归是可以用的,当然华为目前依旧受制于产能,没有办法大规模的供应,不过产能问题就算三年解决不了,五年也是能解决的。DeepSeek参与进来,也是希望华为可以做成这个事情,希望中国厂家可以做成这个事情,因为买不到NVIDIA的芯片,厂家自研芯片就是一个必选项了,希望国产的算力能够成为新的中流砥柱。