梁文锋(Liang Wenfeng),深度求索(DeepSeek)的首席执行官,在一场面向投资人的电话会议中披露了一系列宝贵信息,坦率地谈及了中国的算力缺口、英伟达(NVIDIA)旗下GB300 GPU的卓越性能、华为(Huawei)的精细追赶,以及深度求索目前在数据标注方面的工作。

MSI-GB300.jpeg

深度求索梁文锋表示,华为Atlas 950 SuperPoD能够在性能和价格上完全替代英伟达的GB300 NVL机架,但对于深度求索需要的每块GB300 GPU,则需要4块同等性能的华为Ascend GPU

深度求索的梁文锋在最近一次投资者电话会议中透露了大量有价值的信息。他指出,该AI实验室当前可用的算力,仅能支持模型在任意时刻激活约100亿个参数,而如今最大型的模型一次可激活约8000亿个参数。他接着说道:

“如果我想训练一个像前沿AI那样大的模型,我大约需要5万块GB300,或者20万块华为950。这还只是训练阶段,不包括研究。所以我们与美国之间最大的差距在于资源。”

此外,梁文锋透露,深度求索目前拥有的总算力资源仅相当于2万块英伟达H100 GPU,其中大部分是在“过去一两个月”才到位的,但该AI实验室现在正“极其激进地”扩展其算力规模。

至关重要的一点是,梁文锋断言,华为的Atlas 950 SuperPoD(也称为超级节点)在性能和价格上可以“完全替代”英伟达的GB200和GB300机架:

“我对国产算力相当乐观。在这一点上,我认为英伟达是在自掘坟墓。华为的超级节点——华为950超级节点——在性能和价格上完全可以替代英伟达的GB200和GB300。价格肯定更高,但幅度有限。高出50%或100%——高出100%没关系;即使高出200%也没关系。”

接着,他继续指出:“GB300能做的所有任务,华为的超级节点都能做,延迟等各方面都一样。唯一的代价是:4块华为GPU相当于1块英伟达GPU,并且落后了两年。”

最后,据梁文锋称,深度求索现正加倍投入高质量的数据标注工作,其瓶颈更多在于时间而非资本支出。毕竟,无论是OpenAI还是Anthropic,都更早地投入了更多资源来进行数据标注。


文章标签: #算力对比 #国产芯片 #深度求索 #梁文锋 #华为

负责编辑

  菠萝老师先生 

  让你的每一个瞬间都充满意义地生活,因为在生命的尽头,衡量的不是你活了多少年,而是你如何度过这些年。