华为昇腾950PR要干到75万颗,国产算力不止追性能,开始拼系统级调度,给NPU装上了智能阀门。华为2026年公开,昇腾950PR进入75万颗规模生产计划;对比910C,950的芯片互联带宽提约2.5倍,支持FP8、MXFP8、MXFP4低精度,Atlas 950 SuperPoD规划的NPU规模较900 A3扩大超20倍。单颗追不上,就用系统级计算补。
更实处的变化在软件层。海淀企业范式开源Ascend DRA Driver,给昇腾NPU装了细粒度动态调度。过去云原生里一张卡整块分给一个任务,实际只要20%性能,剩下80%浪费,形成算力孤岛。这套驱动把显存和算力拆成水池,按需取用,还能通过HAMi抽象层跟英伟达GPU统一运维。
这手的意义在哪?国产芯片单颗性能还落后英伟达几年,靠先进制程卡脖子短期解不开。但部署经济学正在取代峰值性能,成为采购决策的主要考量。摩根士丹利说,中国公司未来12个月46%的AI加速器预算会买国产,现在才30%;到2030年国产AI芯片自给率从42%升到70%。华为、寒武纪、海光、沐曦都在沿同一条路走。
短板也要说清。软件生态仍是英伟达CUDA最厚的壁垒,国产框架适配工作量巨大。Ascend DRA这类调度创新是补位不是超越,真要规模化替代,编译器、算子库、开发者习惯,哪一样都得啃硬骨头。
国产算力从能不能用,跨到好不好用、够不够省。华为用系统级和池化这两手,在制裁缝隙里把路走通。投资上别只盯单颗芯片跑分,能打通芯片加集群加框架全栈、把算力利用率顶上来的公司,才是真正值钱的。
