重大影响 2026-07-30

万亿参数大模型竞速白热化:Grok 4.6/4.7对标Kimi K3

马斯克宣布Grok 4.6(1.5万亿参数)8月7日发布,Grok 4.7(2.1万亿参数)数周后跟进,直接对标2.8万亿参数的Kimi K3。全球大模型进入万亿级军备竞赛,参数规模之外,微调质量、强化学习和Token效率成为新竞争维度。

大模型AI芯片AI应用开发

2026年7月28日,马斯克通过社交平台确认xAI下一代大模型Grok 4.6预计将于8月7日前后发布,参数规模达1.5万亿,将在监督微调(SFT)和强化学习(RL)方面实现显著改进。紧随其后,参数量高达2.1万亿的Grok 4.7也将在数周内推出。马斯克还透露计划将SpaceX火箭工厂的"世界级工程数据"喂给Grok,建立竞争对手无法复制的数据壁垒。

Grok路线图的公布时间点颇具意味——就在7月27日月之暗面正式开源2.8万亿参数的Kimi K3之后。Kimi K3登顶Chatbot Arena编程能力排行榜全球第一,综合智能排名全球第三,其开源引发了全球AI社区的强烈反响。马斯克选择在此节点公布Grok计划,被业界解读为对Kimi K3开源的直接回应。全球大模型正在进入万亿参数级别的军备竞赛:Kimi K3以2.8万亿领跑开源阵营,Grok 4.7以2.1万亿紧随其后,OpenAI的GPT-5.6系列和Google的Gemini 4也在预训练中。

值得注意的是,参数规模已不再是唯一的竞争维度。OpenAI同日发布ARC-AGI-3基准复盘显示,仅开启保留推理与压缩两项运行设置,就将GPT-5.6 Sol的表现从13.3%提高到38.3%,说明工程化能力和工具链优化同样关键。监督微调质量、强化学习策略、长上下文处理能力和Token效率正在成为同等重要的差异化要素。对于AI应用开发者而言,多模型并存意味着更丰富的选择,但也增加了模型选型和适配的复杂度。

核心要点

  • Grok 4.6参数1.5万亿,8月7日发布;Grok 4.7参数2.1万亿,数周后跟进
  • 直接对标2.8万亿参数的Kimi K3,全球万亿级军备竞赛
  • 参数规模之外,微调质量、强化学习和Token效率成新竞争维度
  • OpenAI ARC-AGI-3复盘显示工具链配置对评测结果影响巨大
  • 多模型并存增加开发者选型复杂度

前瞻展望

万亿参数模型的密集发布将加速AI能力的商品化进程。对于闭源AI公司的商业模式而言,免费可用的顶级开源模型意味着竞争压力持续增大。预计未来1-2个月,基于各万亿级模型的微调和垂直适配将大量涌现。模型评测体系也将从"裸分比较"转向包含工具链、记忆机制和执行环境的综合评估。

更多时势报告