新模型发布

阿里开源2.4万亿参数Qwen3.8-Max:千问首次开放旗舰模型权重

2026年8月13日,阿里千问大模型团队正式开放Qwen3.8-2.4T-A95B模型权重,这是千问首次将Max级别的旗舰模型对外开源。Qwen3.8-Max基于Qwen3.8-2.4T-A95B架构,模型总参数为2.4万亿,每个Token激活950亿参数,原生支持262144 Token上下文,可扩展至101万Token。模型采用Qwen3.5底层架构,在编程、办公、科研工作、长周期智能体任务上实现性能提升。

基准测试方面,Qwen3.8-Max在论文复现基准PaperBench中取得93.0分,高于GPT-5.6 Sol、Fable 5和Claude Opus 4.8;在电脑操作能力OSWorld-Verified中以86.1分位居参评模型首位。但在软件工程SWE-bench Pro中67.7分落后于Fable 5的80.0分。Qwen3.8-Max的重点是让模型脱离人工持续陪伴,自主完成跨度数小时、数天甚至数周的任务——团队让模型连续自主编程约16天,构建了自进化Harness,持续完成社区需求收集、issue派发、代码生成、验证与自我修复。

同期,Unsloth AI靠动态1-bit分层选择性量化技术,将原始4.9TB的模型体积压缩至397GB,存储空间缩减91%,设备内存+显存总量达到410GB以上即可本地运行。API价格方面,国内每百万Tokens输入12元、输出36元;海外输入2美元、输出6美元。千问团队预告更小杯Qwen3.8-27B已在路上。此次开源是中国开源大模型布局的关键落子,与同日发布的DeepSeek V4 Pro和Grok 4.6形成"三强同日混战"格局。

← 返回AI热点列表