Ox Alpha身份揭晓:智谱GLM-5.3-Flash确认开源,10万张国产算力卡承载,使用量是DeepSeek两倍
2026年8月28日,持续一周的"AI侦探游戏"终于落幕。8月26日晚,智谱Z.ai正式确认,此前以匿名模型Ox Alpha身份在OpenRouter上走红的"牛来"大模型,正是其最新发布的GLM-5.3-Flash(320B-A18B)。因代号Ox在英文中意为"牛",恰逢热门电影《牛来》走红,中文社区亲切地将其称为"牛来大模型"。智谱同步开源了模型权重,采用MIT协议——这是最宽松的开源协议之一。
GLM-5.3-Flash的技术规格令人瞩目。作为GLM-5系列首个原生多模态模型,总参数320B、每Token仅激活18B参数,采用稀疏注意力与线性注意力混合架构。这意味着模型虽然总规模达3200亿参数,但每次推理只使用180亿参数,大幅降低了推理成本。更引人注目的是,全部线上流量由10万张国产芯片承载——摩尔线程基于MTT S5000智算卡在发布当日完成Day-0适配。这标志着国产AI芯片在大规模推理场景中的实战能力得到验证。在OpenRouter平台上,Ox Alpha的使用量是DeepSeek的两倍多,免费期将持续至9月9日,之后输入100万token收费0.07美元。
Ox Alpha事件的意义远超一次模型发布。首先,它开创了"匿名发布→引爆关注→揭晓身份→开源权重"的新型营销模式——智谱先用匿名模型在海外社区证明实力,再正式揭晓身份并开源,最大化了国际关注度。其次,10万张国产芯片承载全部流量的事实,证明中国AI算力供应链已经具备大规模推理能力——摩尔线程MTT S5000在Day-0完成适配,说明国产芯片的软件生态正在快速成熟。第三,MIT协议开源意味着任何人都可以自由使用、修改和商用——这将加速GLM-5.3-Flash在企业级场景的部署。对AI行业而言,智谱的"匿名逆袭"策略可能被更多中国AI公司效仿——先用实力说话,再公开身份,避免先入为主的偏见。对AI工具用户而言,GLM-5.3-Flash的开源意味着又一款强大的开源多模态模型可供选择,320B总参数但仅18B激活的设计使其在保持高性能的同时大幅降低了使用成本。