铭鸿体育资讯网

MiMo 四个多月没发新版了,很多人以为它掉队了。我的判断恰恰相反——它可能是在"玩大的"。 三月份它直接把 1T 参数 + 1M 上下文的顶配模型摆了出来。 参数一旦上这个量级,迭代难度是指数级上升的: 要更多 B 卡、更高质量的数据、更复杂的训练和训练流程。 沉默不是没进展,是为下一代憋更重的工 ​

MiMo 四个多月没发新版了,很多人以为它掉队了。我的判断恰恰相反——它可能是在"玩大的"。

三月份它直接把 1T 参数 + 1M 上下文的顶配模型摆了出来。

参数一旦上这个量级,迭代难度是指数级上升的:

要更多 B 卡、更高质量的数据、更复杂的训练和训练流程。

沉默不是没进展,是为下一代憋更重的工程代价。

领先的背后,本质是资金效率和算力预锁定量。

尤其现在——有钱也不一定能搞定算力。

所以一句大实话:

在资源紧缺的情况下,越早走向自迭代、越早锁定算力,越能走得更顺。

所以,小米的钱够吗?小米科技