科技·via @mubei·86.7 分
1.5 万亿参数。 xAI 的 Grok v9 基础模型刚刚跑完训练。 体量直接膨胀到上一代 v8 的整整 3 倍。 底…
1.5 万亿参数。 xAI 的 Grok v9 基础模型刚刚跑完训练。 体量直接膨胀到上一代 v8 的整整 3 倍。 底层算力也完成了跨代跳跃。 v8 还在跑 Hopper,v9 已经是原生 Blackwell 训练出的产物。
数据筛选机制被团队推倒重来。 训练配方也是全新调配的。 Cursor 的数据还在排队,准备作为补充包喂进模型。 现在公众在前端用的 Grok 4.2,底下跑的依然是老款 v8。
新旧两代之间差了多少? 马斯克给出的原话只有一个词:GIGANTIC(巨大)。 等 v9 的权重正式替换掉前端的壳子,硅谷大模型牌桌上的算力门槛又得往上提一档。
相关 / RELATED
JSON- M科技1.5 万亿参数的大底座跑通了。 马斯克交底,xAI 正式完成 Grok V9 基础模型的训练。 内部代号 V9,体量直…
- M“SpaceX + 特斯拉 = Grok 4 的解题锚点。” 有人抛出这个公式,马斯克只回了一个词:是的。 Grok 正…
- MAI 的核心计量单位,变了。 不再是囤了多少张 GPU,而是“吉瓦”(GW)。 马斯克交了底。 今年年底,他的算力规模要…
- MOpenAI 的下一代模型已经进入发射序列。 内部给出的定性是:一次非常重大的跨越。 现有的模型已经足够强大。 但新一代…
- M科技英伟达刚用 4-bit 精度,跑完了一个 120 亿参数大模型的预训练。 喂进去的数据量是 10 万亿 token。 以…
- MAndrej Karpathy揭开了一个反直觉的行业真相。 现在的AI模型动辄上万亿参数,根本不需要这么大的“脑容量”。…
导出 / EXPORT
订阅 · SUBSCRIBE
每周一封信号简报,重大进展可选即时推送。