科大讯飞发布星火X2.5大模型:MoE架构293B参数,纯国产算力训练推理
2026年9月8日,科大讯飞于9月7日发布星火X2.5大语言模型。该模型采用混合专家架构,总参数量293B,激活参数30B,重点强化了编码能力和智能体能力。最引人注目的是,星火X2.5的训练和推理全程使用国产算力基础设施完成,标志着国产大模型在"纯国产算力"路线上迈出关键一步。
除旗舰模型外,科大讯飞还于9月1日提前发布了两款端侧开源模型——星火X2.5-4B和星火X2.5-1.7B,均支持原生100万token上下文窗口。100万token的上下文意味着模型可以一次性处理约75万字的中文文本——相当于一整部长篇小说或数万行代码——这在国内开源模型中属于领先水平。端侧模型的开源也意味着开发者可以在本地设备上免费运行这些模型,降低AI应用门槛。
星火X2.5的发布具有多重战略意义。第一,证明了国产算力的可用性。此前DeepSeek部署16万颗昇腾950DT主要用于推理解码,而科大讯飞星火X2.5的训练也全程使用国产算力,这意味着国产AI芯片已经能够支撑大模型的完整生命周期——从训练到推理。第二,MoE架构的选择反映了效率优先策略。293B总参数但仅激活30B,意味着每个推理请求只动用约10%的参数,大幅降低了推理成本,同时保持了接近稠密模型的性能。第三,聚焦编码和智能体能力而非通用对话,显示科大讯飞选择了差异化竞争路线——在编程和自动化工作流领域与OpenAI Codex等竞争。
星火X2.5的发布与同日华为麒麟9050 Pro芯片发布形成呼应——一个在AI模型层面、一个在芯片层面,共同推进中国AI产业的"算力-模型"双自主。加上工信部同日发布的《2026-2028年人工智能中小企业创业支持行动计划》,中国正在从芯片、模型、应用和政策四个层面系统性地推进AI产业自主可控。在全球AI竞争格局中,"纯国产算力训练"这一里程碑可能加速更多中国AI公司转向国产芯片,减少对英伟达的依赖。