在一次投资者电话会议上,DeepSeek首席执行官梁文峰对英伟达的霸主地位提出了挑战:华为硬件将完全取代GB300系统。
DeepSeek创始人兼首席执行官梁文峰在一次投资者会议上,就中国在计算能力领域的追赶态势以及英伟达发表了不同寻常的直率言论:
对于国内的计算能力,我相当乐观——在这一点上,英伟达正在自掘坟墓。
华为950对决英伟达GB300:DeepSeek首席执行官的分析
具体而言,文峰声称,华为的“Atlas 950 SuperPoD”——一种所谓的“超级节点”,即由众多加速器紧密耦合而成的集群——在性能和价格方面完全可以替代英伟达的“GB200”和“GB300”机架。虽然价格更高,但仍在可接受范围内:无论贵50%、100%甚至200%,文峰认为这最终并不重要。
但他自己也指出了其中的弊端:要达到英伟达GPU的性能,需要四颗华为芯片,而且技术上落后了大约两年。
- 四颗华为950芯片相当于一颗GB300——据温峰称,两者的延迟和任务范围相同。
- 华为超级节点预计将于2026年第三或第四季度投入运行,而英伟达的GB200则是在两年前的第三季度上市的。
中国的计算能力差距:美国为何领先
文峰认为,中国与美国的差距在于资源而非人才——人才缺口恰恰源于计算能力的不足。据这位DeepSeek首席执行官介绍,当前最大的AI模型可同时激活约8000亿个参数,而中国模型仅能激活约100亿个——差距达一个数量级之多。
文峰在投资者电话会议上的完整发言记录。他在这里表现得更加犀利。他坚称开源是*唯一*的议程。如果你不认同,就去多买些智普的股票吧。
最关键的是,他说克制是*生存的唯一途径*。那些妄图“吞并世界”的实验室将被淘汰。https://t.co/tTCa83rxak pic.twitter.com/XhqVm3zuMK— Teortaxes▶️ (DeepSeek 推特铁粉 2023 – ∞) (@teortaxesTex) 2026年7月23日
据文峰称,要训练这一级别的模型,大约需要50,000个GB300或约200,000个华为950——这还不包括研发所需。华为目前为DeepSeek提供了约16,000个加速器的算力;瓶颈在于华为的生产环节。
日渐式微的优势:CUDA与TileLang论点
英伟达常被提及的优势在于其软件平台“CUDA”,许多人工智能开发者都依赖该平台。而文峰认为,正是这一优势正在逐渐消失:如今人工智能系统已能自行编写所需代码,此外还有一款名为“TileLang”的自研工具,可用于复现英伟达的生态系统。
他以自家开发的“V3”模型为例加以佐证:虽然该模型运行在英伟达硬件上,但在训练过程中却通过自编的 TileLang 编译器脱离了英伟达的软件环境。他认为,专为人工智能设计的专用芯片使得 CUDA 的优势日益变得无关紧要。

