7月30日,马斯克在社交平台X上甩出一条重磅消息:Grok 4.6将在8月7日正式发布,参数规模达到1.5万亿。更让人意外的是,他紧接着透露几周后还会推出Grok 4.7——参数直接拉到2.1万亿。
这意味着SpaceXAI正在以接近”每周一更”的节奏推进大模型迭代。从7月8日Grok 4.5开放公测,到4.6定档,再到4.7预告,短短一个月内完成三代模型的接力发布。
Grok 4.6:不只是”更大”
马斯克在帖文中特别提到,Grok 4.6的提升重心不在参数量级本身,而是监督微调(SFT)和强化学习(RL)两个维度。简单说,模型不光”知道更多”,还要”做得更好”。
SFT是通过大量人工标注数据让模型学会正确的输出模式,RL则是让模型在试错中自我优化。两者结合的效果,通常体现在对话质量、指令遵循能力和复杂任务处理上。

Grok 4.5此前被马斯克称为”Opus级别”,主要亮点是推理速度更快、Token利用效率更高、推理成本更低。4.6在此基础上进一步强化训练方法,目标是在同等参数规模下提升实际表现。
2.1万亿的Grok 4.7:参数竞赛没有终点
如果说4.6是”精细化打磨”,4.7走的就是”暴力美学”路线——参数从1.5万亿直接跳到2.1万亿,增幅40%。

这个数字意味着什么?作为参照,GPT-4发布时传闻参数量约1.8万亿,Grok 4.7将显著超越这一水平。不过需要注意的是,参数规模不等于实际能力,训练数据质量、架构设计、后训练策略同样关键。DeepSeek刚发布的V4-Flash就是最好的例子——2840亿参数MoE架构,激活参数仅130亿,却在9项Agent基准测试中全面超越自家的V4-Pro。
马斯克显然深谙”参数即叙事”的传播逻辑。在AI行业,参数规模依然是吸引开发者关注和资本市场信心的有效手段。
发布节奏背后的商业算盘
SpaceXAI的高频发布策略并非单纯的技术驱动,背后有清晰的商业考量。
首先是竞争卡位。OpenAI正在筹备代号”Astra”的多智能体模型,Anthropic则以9650亿美元估值冲刺IPO。在对手频繁放大招的窗口期,保持发布节奏就是保持市场存在感。

其次是生态建设。Grok模型深度集成在X平台中,用户可以直接在社交场景中使用AI能力。高频更新能够持续拉动X平台的用户活跃度和停留时长,为马斯克的”超级应用”战略提供支撑。
第三是开发者心智争夺。大模型的商业化最终依赖API调用量,而开发者倾向于选择更新最积极、能力迭代最快的模型。通过密集发布,SpaceXAI试图在开发者社区建立”持续进化”的品牌认知。
行业格局:参数军备赛进入新阶段
2026年下半年,大模型行业正呈现几个明显的趋势变化。
发布周期急剧缩短。过去大模型通常半年到一年更新一代,现在头部厂商已经压缩到数周甚至更短。OpenAI的Sol/Terra/Luna三大系列并行推进,DeepSeek的V4家族连续发布预览版和正式版,谷歌Gemini也在持续迭代。
竞争焦点从”谁更大”转向”谁更能干活”。OpenRouter最新数据显示,全球AI大模型周调用量前五全为中国模型,中国模型整体份额达63.5%。这些模型的共同特点是Agent能力突出、API价格激进,以实际使用效果而非参数规模赢得开发者。
多智能体协作成为下一个突破口。OpenAI的Astra模型主打多智能体长期协作能力,腾讯WorkBuddy推出”人机双写”功能,字节将飞书与豆包团队整合——行业正在从”单模型能力比拼”过渡到”系统级解决方案竞争”。
在这个背景下,马斯克的Grok系列能否靠参数优势突围,8月7日的4.6发布将是一个重要验证节点。






