铭鸿体育资讯网

英伟达悄悄重启了一个关键芯片项目,芯片功耗2300瓦、配168GB HBM4内存

英伟达悄悄重启了一个关键芯片项目,芯片功耗2300瓦、配168GB HBM4内存,专门攻AI推理的"预填充"环节。
9月1日,分析师郭明錤披露,英伟达已重启Rubin CPX推理加速GPU项目,设计做了大幅调整,预计2027年Q1开始生产。新Rubin CPX的算力接近标准Rubin GPU,但预填充性能进一步提升——所谓预填充,就是AI在回答你问题之前,先把上下文"预读"一遍的过程,这是推理环节最吃算力的部分之一。
为什么这个消息值得关注?因为它说明英伟达在赌一个趋势:AI推理的需求会远超训练。训练大模型是一次性的,但推理是持续的——每多一个用户、每多一次对话,都需要推理算力。当百万Token甚至千万Token的超长上下文成为常态,预填充的算力消耗会呈指数级增长。
2300瓦的单体功耗什么概念?一张RTX 5090的功耗大概500多瓦,这张卡是它的4倍多。这意味着它不是给个人用户的,而是数据中心的专用"推土机"。
但更深层的信号是:英伟达不打算只做训练芯片,它要吃下推理市场。此前英特尔刚披露了Crescent Island推理GPU(480GB显存、不用HBM),AMD也在推MI系列推理卡。推理市场的争夺战,才刚刚开始。
你觉得AI推理和训练,哪个市场更大?