新模型发布

字节跳动讨论训练超5万亿参数大模型:国内已知最大规模,参数竞赛再升级

2026年8月7日,据每日经济新闻报道,字节跳动正在内部讨论训练一个参数规模超过5万亿的大模型。这一规模将超过阿里Qwen3.8-Max的2.4万亿参数和月之暗面K3的2.8万亿参数,成为目前国内已知参数规模最大的模型训练计划。不过该计划仍处于早期讨论阶段,尚未最终确定。

字节跳动的5万亿参数计划是近期大模型参数竞赛持续升级的最新信号。7月以来,万亿级模型密集发布:月之暗面K3以2.8万亿参数登顶Arena编程全球第一并开源;阿里Qwen3.8-Max以2.4万亿参数排名Arena全球第五并将于下周开源权重;xAI Grok 4.6以1.5万亿参数发布并预告2.1万亿的Grok 4.7;DeepSeek V4 Flash以284B参数(13B激活)登顶OpenRouter全球调用量第一。如今字节跳动直接将目标拉到5万亿,意味着大模型参数竞赛远未到顶。

参数竞赛的背后是算力、数据和资金的全面较量。5万亿参数模型的训练需要数千张乃至上万张高端GPU,仅硬件投入就可能超过数十亿元。字节跳动拥有庞大的用户数据和资金实力,但在自研大模型赛道上起步较晚——此前主要依赖豆包系列模型,参数规模远低于5万亿。如果该计划落地,字节将直接跻身全球大模型第一梯队。不过,业界对"唯参数论"的质疑也在增加——OpenAI和Anthropic已不再公开参数规模,强调"参数效率"和"训练后优化"的重要性。DeepSeek V4 Flash仅284B参数却登顶全球调用量第一,说明参数规模不再是衡量模型能力的唯一标准。字节的5万亿计划能否真正转化为性能突破,还有待验证。对AI工具用户而言,参数竞赛升级意味着未来将有更强大的国产大模型可供选择,但选择工具时更应关注实际场景适配度而非参数数字。

← 返回AI热点列表