铭鸿体育资讯网

现在来看,黄仁勋之前作出的预测,十有八九是对的。 黄仁勋此前说DeepSeek

现在来看,黄仁勋之前作出的预测,十有八九是对的。

黄仁勋此前说DeepSeek首次跑在华为芯片上,对美国是个可怕的结果。当时都以为他在帮英伟达要政策。现在看,他是认真的。
DeepSeek选华为,不是退而求其次,是强强联手。

今年4月15日,黄仁勋在一档播客专访里说了句很重的话:“如果DeepSeek先在华为平台上发布,那对我们国家来说将是灾难性的。”当时听着像危言耸听,结果仅仅9天之后,这话就应验了。

4月24日,DeepSeek V4正式发布,华为计算随即宣布昇腾超节点全系列产品全面支持DeepSeek V4。

更关键的是,DeepSeek在V4开发过程中,专门花了好几个月跟华为合作,把底层代码从依赖CUDA的技术路径,转向了华为自研的CANN生态。

这意味着什么?意味着一个中国最顶尖的大模型,至少在推理端,已经可以不依赖英伟达的卡了。

黄仁勋真正怕的不是少卖几块GPU。他自己在访谈里说得很清楚——“假设它是针对华为优化的,针对他们的架构优化了,那就会让我们处于劣势”。

说白了,英伟达的护城河从来不是芯片本身,而是CUDA生态。过去所有大模型都莫认在CUDA上做首发优化,华为也好、AMD也好,性能再接近也只能当备选。因为迁移成本太高,没人愿意重写代码。

但DeepSeek这次直接把优先期给了华为,确保V4在昇腾950上高效运行。

实侧数据也很能打:8K输入场景下,昇腾950超节点跑V4-Pro的单token解码时延约20毫秒,V4-Flash约10毫秒。适配的昇腾950PR推理芯片,单卡算力比英伟达对华特供的H20提升了2.87倍,采购价却只有四分之一。

所以DeepSeek选华为,真不是退而求其次,是强强联手。这件事戳破的,是“开源模型必须以CUDA为首要优化目标”这条默认规则。一旦这条规则被打破,就会有更多工程师、更多优化经验沉淀到非CUDA路径上。

黄仁勋自己都承认,英伟达在中国市场的份额已经从2024年的70%降到了2025年的55%。

说到底,黄仁勋的焦虑不是没有道理。他看到的不是一款芯片被替换,而是一整个生态开始有了第二条路可走。