埃隆·马斯克透露,Grok 4.6 的训练已进入收尾阶段,其拥有 2 万亿参数的模型预计将在下周完成初步训练。
据马斯克称,这款 2 万亿参数的模型在各项性能上都超越了当前 1.5 万亿参数的版本。同时,该新模型的推理速度和 Token 效率预计将与现有的 1.5T 模型(即 Grok 4.5)相当。他推测,这款模型甚至可能在性能上超越月之暗面最新的 Kimi 3 模型。
截至目前,xAI 公司尚未正式公布 Grok 4.6 的发布日期、具体的训练过程以及全部技术规格。此前,xAI 已陆续发布了 Grok 系列的多个版本。
在模型规模方面,马斯克曾在 2026 年 5 月表示,Grok 的基础模型 V9-Medium(拥有 1.5T 参数)已完成训练,并进入了后续的微调和强化学习阶段。该模型被认为是 Grok 4.5 的基础。如果此次的 2T 参数模型最终成功完成并发布,Grok 的参数规模将得到进一步的扩展。
通常情况下,大语言模型中的参数数量被用作衡量模型规模的指标,但模型的实际能力还受到训练数据的质量、训练方法、推理架构、计算资源以及后期优化等多种因素的影响。马斯克在此强调的是,xAI 在扩展模型规模的同时,也致力于保持与上一代模型相近的运行效率。
从发展策略来看,xAI 正在持续增加在计算资源方面的投入。该公司此前曾披露,Grok 4 的训练使用了名为 Colossus 的大型 AI 计算集群,该集群配备了约 20 万块 GPU,用于强化学习和模型训练。
与此同时,AI 大模型领域的竞争焦点在于模型规模、推理能力、响应速度以及成本效益。包括 OpenAI、谷歌、Anthropic 在内的多家公司也在不断推出其新一代模型,行业普遍关注如何在提升模型能力的同时有效控制推理成本。