阿里开源Qwen3.8-2.4T-A95B模型,总参数2.4万亿

8月13日 00:10
该权重于8月12日深夜通过魔搭社区发布,是Qwen Max级别首次开放,原生支持26万上下文,旨在提升编程与长周期任务能力。

阿里巴巴通义千问团队于2026年8月12日深夜正式对外发布Qwen3.8-2.4T-A95B模型权重,此举标志着该系列Max级别旗舰模型首次实现开源。此次开放的模型总参数量达到2.4万亿,采用混合专家架构(MoE),在推理过程中每个Token激活参数量为950亿。该模型基于Qwen3.5底层架构构建,原生上下文窗口支持262,144 Token,并具备扩展至1,010,000 Token的能力,重点优化了编程、办公、科研及长周期智能体任务的端到端完成效率。

在技术细节与部署方面,该模型每个MoE层包含512个专家,单次推理时每个Token选择10个路由专家并激活1个共享专家。模型训练阶段引入了多步MTP(Multi-Token Prediction)机制,以支持推理引擎预测多个后续Token。开源版本默认开启思考模式,生成内容前会输出由特定标记包裹的推理过程,且当前不支持关闭该模式。开发者可利用SGLang、vLLM及TokenSpeed等主流推理引擎进行部署,需配合框架针对Qwen3.8发布的最新Recipe,并根据硬件配置调整并行策略。

官方发布的评测数据显示,该模型在PaperBench、IFBench等基准测试中表现突出,与Opus 4.8、Fable 5、GPT 5.6 Sol等竞品模型相比,各项指标互有优劣。云端版Qwen3.8-Max已于8月3日上线,除基于此开源权重外,还额外集成视觉输入、工具调用及无需思考模式等功能。此次开源后,后续预计还将推出参数量更小的Qwen3.8-27B版本,进一步丰富该系列的模型矩阵。