马斯克称 Grok 4.6 进入训练收尾:2 万亿参数模型或下周完成初训
据 IT之家 7 月 18 日消息,埃隆·马斯克今日在 X 平台回复网友时透露,xAI 正在训练的下一代 Grok 4.6 模型已进入后期阶段,参数规模将达到 2 万亿,预计下周完成初始训练。马斯克表示,这一新模型在各方面都将优于当前的 1.5 万亿参数版本,同时推理速度和 Token 效率有望接近现有 1.5T 模型,也就是外界所称的 Grok 4.5。对于具体发布时间、训练方案和完整指标,xAI 目前尚未正式公布。
从 1.5T 到 2T:Grok 继续押注大规模模型路线
来源显示,马斯克此前曾在 2026 年 5 月提到,Grok 基础模型 V9-Medium,即 1.5T 参数模型,已经完成训练,后续进入微调和强化学习阶段。该模型被认为是 Grok 4.5 的基础版本。此次如果 2T 参数模型最终完成训练并对外发布,意味着 Grok 系列将在模型规模上继续向上推进。
在大语言模型语境中,参数量通常被用来描述模型容量和复杂度,但它并不等同于模型的全部能力。模型实际表现还受到训练数据质量、数据配比、架构设计、推理系统、强化学习策略以及后训练优化等多方面因素影响。因此,Grok 4.6 是否能在真实任务中显著领先上一代,仍需要等待基准测试、开发者体验和用户侧反馈来验证。
值得注意的是,马斯克还提到,2T 模型在保持能力提升的同时,推理速度与 Token 效率将接近 1.5T 版本。这一点对于商业化落地尤其关键,因为更大的模型通常意味着更高的计算开销。若 xAI 能在扩展参数规模的同时控制推理成本,Grok 4.6 的可用性和部署空间将更具想象力。
马斯克提及 Kimi 3,竞争焦点转向能力与效率并重
在回复中,马斯克还猜测 Grok 4.6 可能会超过月之暗面最新 Kimi 3。不过,来源并未提供双方模型的公开对比数据,也没有披露评测任务和测试条件。因此这一说法更适合视为马斯克对 xAI 新模型的预期,而非已经被第三方验证的结论。
从行业背景看,大模型竞争已经不再只是“参数越大越好”的单线竞赛。OpenAI、谷歌、Anthropic、月之暗面等厂商都在围绕推理能力、长上下文、工具调用、多模态、响应速度和成本效率展开竞争。对企业用户和开发者而言,模型是否好用,往往取决于它在具体场景中的稳定性、价格、延迟、上下文处理能力和生态支持。
- 模型规模:Grok 4.6 据称将达到 2 万亿参数,高于当前 1.5T 版本。
- 训练进度:马斯克称其预计下周完成初始训练,但正式发布时间尚未公布。
- 效率目标:xAI 希望新模型在提升能力的同时,保持接近 Grok 4.5 的推理速度和 Token 效率。
- 竞争对象:马斯克提及 Kimi 3,但目前缺少公开、统一条件下的评测依据。
对 AI 产业的影响:算力投入仍是核心门槛
xAI 持续扩大模型规模,背后离不开算力基础设施投入。来源摘要提到,xAI 此前公布 Grok 4 使用名为 Colossus 的大型 AI 计算集群进行训练,该集群拥有约 20 万块 GPU,用于强化学习和模型训练。这说明在前沿模型竞争中,算力集群、训练调度和工程效率已经成为与算法同等重要的基础能力。
对于中文科技读者而言,Grok 4.6 的看点不只在于“2 万亿参数”这一数字,而在于 xAI 是否能证明大模型扩容仍能带来可感知的能力提升,并将成本控制在可商业化范围内。如果新模型发布后能在复杂推理、代码、工具使用或多轮任务中体现优势,Grok 系列在全球大模型格局中的存在感将进一步增强。反之,如果效率和稳定性不足,单纯扩大规模也难以转化为用户价值。
目前,Grok 4.6 仍处于训练信息披露阶段。接下来外界需要关注的是:xAI 何时发布正式版本、是否开放 API 或产品入口、是否给出系统卡和评测结果,以及它在真实应用场景中能否兑现能力提升与成本效率并行的目标。