重大影响 2026-08-28

MoE架构爆发与具身智能突破:智谱Ox Alpha揭晓10万国产卡承载,阿里6B激活125B降本90%,千寻击败英伟达登顶具身榜

2026年8月28日,五条线索共同指向AI产业两个核心趋势的加速。MoE架构爆发:智谱GLM-5.3-Flash(Ox Alpha身份揭晓)320B总参数仅激活18B,10万张国产芯片承载全部流量;阿里Qwen3.8-Flash 125B仅激活6B,训练成本降90%办公基准超Claude Opus 4.6。具身智能突破:千寻智能Spirit v1.6在RoboArena击败英伟达Cosmos 3登顶,首个中国具身模型世界第一,三个月融资近50亿。物理AI进化:小鹏VLA从3D空间理解跃迁至4D时空理解。Google加速迭代:Gemini 3.8 Flash内部测试已好于3.7,Omni 1.1 Flash视频生成达4K。MoE稀疏激活成为性价比共识,具身智能成为下一个竞争焦点。

大模型AI芯片具身智能自动驾驶视频生成

2026年8月28日,五条重磅消息共同指向AI产业两个核心趋势的加速——MoE(混合专家)架构全面爆发和具身智能突破性进展。第一条是智谱GLM-5.3-Flash身份揭晓。8月26日晚智谱正式确认,此前以匿名模型Ox Alpha身份在OpenRouter刷屏的"牛来"大模型正是GLM-5.3-Flash(320B-A18B)——GLM-5系列首个原生多模态模型,总参数320B、每Token仅激活18B,采用稀疏注意力与线性注意力混合架构,MIT协议开源。最引人注目的是全部线上流量由10万张国产芯片承载,摩尔线程MTT S5000在发布当日完成Day-0适配。在OpenRouter使用量是DeepSeek两倍多。

第二条是阿里Qwen3.8-Flash发布。125B总参数仅激活6B的MoE架构,搭配51B N-gram Embedding记忆库。在CoWorkBench办公工作流基准上获73.9分远超Claude Opus 4.6的45.1分。训练成本仅为Qwen3.7-Plus的1/9,API定价每百万Tokens输入1元输出3元。Apache 2.0协议开源。6B激活参数意味着推理成本接近6B小模型但能力远超——"小成本大能力"组合定义了开源大模型性价比天花板。

第三条是千寻智能Spirit v1.6登顶RoboArena。在英伟达联合硅谷顶级机构主导的世界级具身智能榜单上综合得分全球第一,力压英伟达Cosmos 3和Physical Intelligence Pi0.5——首个中国具身模型登顶。就在两天前黄仁勋刚发布Cosmos 3登上多个榜首,荣耀只持续一天就被千寻反超。三个月融资近50亿,雷军顺为资本和马云云锋基金入局,与博世、京东达成合作。

第四条是小鹏VLA从3D到4D的跃迁。第二代VLA大模型升级让AI第一次建立时间维度理解——从静态3D空间理解进化到动态4D时空理解(记住过去、理解当下、预判未来)。三项核心技术:时序记忆模块、动态场景推理引擎、未来轨迹预测网络。XOS 6.3.0将在G9L全球首发。这是自动驾驶AI架构的范式升级——从"帧级感知"到"时空理解"。

第五条是Google加速迭代。Gemini 3.8 Flash Preview已在内部编程平台Jetski上向员工开放测试,体验明显好于3.7 Flash。Google以数周间隔快速迭代追赶OpenAI和Anthropic。同日发布Gemini Omni 1.1 Flash多模态视频生成模型——场景延展至40秒、关键帧控制、4K输出,从演示级升级到生产级。

这五条线索合在一起勾勒出AI产业的新格局:MoE稀疏激活架构已成为性价比共识——智谱320B激活18B、阿里125B激活6B,两种参数规模都通过稀疏激活实现了"大模型能力+小模型成本"的组合。这种架构正在成为开源大模型的主流选择。具身智能正在成为继大语言模型之后的下一个AI竞争焦点——千寻击败英伟达登顶RoboArena,小鹏将4D时空理解引入自动驾驶,AI正从"屏幕里"走向"物理世界"。对AI工具用户而言,MoE架构的普及意味着更便宜更强大的开源模型将持续涌现,具身智能的突破意味着AI将在物理世界中扮演越来越重要的角色。

核心要点

  • 智谱GLM-5.3-Flash身份揭晓:Ox Alpha即"牛来",320B总参数仅激活18B,MIT开源,10万张国产芯片承载全部流量
  • 阿里Qwen3.8-Flash:125B总参数仅激活6B,训练成本降90%,办公基准73.9分超Claude Opus 4.6的45.1分
  • MoE稀疏激活成为性价比共识:智谱18B激活+阿里6B激活,"大模型能力+小模型成本"组合成主流
  • 千寻智能Spirit v1.6登顶RoboArena:首个中国具身模型击败英伟达Cosmos 3世界第一,三个月融资近50亿
  • 小鹏VLA 4D时空理解:从3D空间感知跃迁到4D时空理解,记住过去理解当下预判未来,G9L首发XOS 6.3.0
  • Google Gemini 3.8 Flash内部测试已好于3.7,数周迭代追赶OpenAI,Omni 1.1 Flash视频生成达4K生产级
  • 具身智能成为继大语言模型之后下一个AI竞争焦点——AI从"屏幕里"走向"物理世界"

前瞻展望

MoE架构的全面爆发和具身智能的突破性进展,正在重塑AI产业的竞争格局和技术路线。MoE架构层面,稀疏激活已成为大模型性价比的共识——智谱320B激活18B、阿里125B激活6B,两种参数规模都通过稀疏激活实现了"大模型能力+小模型成本"的组合。这种架构正在成为开源大模型的主流选择,未来可能会有更多模型采用MoE设计。对AI工具用户而言,MoE架构的普及意味着更便宜更强大的开源模型将持续涌现——每百万Token输出3元的定价将成为新的性价比基准。10万张国产芯片承载智谱全部流量的事实,也标志着国产AI芯片在大规模推理场景中的实战能力得到验证——中国AI算力供应链正在快速成熟。具身智能层面,千寻Spirit v1.6在英伟达主导的榜单上击败英伟达自己的模型,这种"在别人制定的规则下赢别人"的成绩对整个中国具身智能行业是巨大信心提振。具身智能可能成为继大语言模型之后的下一个AI竞争焦点——当AI从"屏幕里"走向"物理世界",其市场空间和应用价值将远超当前软件AI的边界。小鹏VLA的4D时空理解则代表了自动驾驶AI架构的范式升级——从"看见"到"预判"可能是通向L4+的关键技术路径。Google的加速迭代反映了AI模型竞赛的白热化——以数周为间隔更新模型已成为常态,这种速度对整个行业都是压力。对AI行业而言,这些变化意味着AI正在从"软件"扩展到"硬件+软件"——从在屏幕上输出文字和图像,到在物理世界中驾驶车辆和操作机器人。AI的边界正在以前所未有的速度扩张。

更多时势报告