MiMo 四个多月没发新版了,很多人以为它掉队了。我的判断恰恰相反——它可能是在"玩大的"。
三月份它直接把 1T 参数 + 1M 上下文的顶配模型摆了出来。
参数一旦上这个量级,迭代难度是指数级上升的:
要更多 B 卡、更高质量的数据、更复杂的训练和训练流程。
沉默不是没进展,是为下一代憋更重的工程代价。
领先的背后,本质是资金效率和算力预锁定量。
尤其现在——有钱也不一定能搞定算力。
所以一句大实话:
在资源紧缺的情况下,越早走向自迭代、越早锁定算力,越能走得更顺。
所以,小米的钱够吗?小米科技