发生了什么
8月12日深夜,阿里云魔搭ModelScope社区宣布,阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重。这是Qwen-Max级别模型首次开源权重,此前Qwen-Max系列旗舰模型仅通过云端API提供服务。模型页面已在魔搭社区上线,企业可自行下载部署。
模型规格与架构
- Qwen3.8-2.4T-A95B为因果语言模型,总参数达2.4万亿,采用MoE稀疏架构,每个Token仅激活95B参数,推理成本显著低于稠密同规模模型
- 每个MoE层包含512个专家,每个Token选择10个路由专家并同时激活1个共享专家
- 原生支持262,144 Token上下文窗口,可扩展至1,010,000 Token,适配长文档与长周期智能体任务
- 模型采用多步MTP(Multi-Token Prediction)训练,支持推理引擎一次预测多个后续Token,提升生成效率
行业意义
官方云端产品Qwen3.8-Max即基于该开放权重模型构建,并额外叠加了面向生产环境的能力。在官方评测中,模型覆盖编程智能体、通用智能体、专业工作与长上下文等方向,与Opus 4.8、Fable 5、GPT 5.6 Sol等模型相比互有高低,并在PaperBench、IFBench等基准上取得所列模型中的较高成绩。
对国内企业而言,Qwen-Max级模型权重的开放意味着可以在自有或私有化环境中部署此前仅能通过API调用的旗舰级模型,在数据合规、推理成本控制与二次微调方面获得更大灵活性。值得注意的是,近期DeepSeek V4 Pro正式版、Meta Muse Glimmer等开源模型密集发布,头部厂商正围绕开源权重展开新一轮生态竞争,企业在大模型选型时面临更多自主可控的选项。
尚待观察
目前官方尚未披露该模型的具体开源许可条款(是否允许商用、是否设置营收分成门槛)以及2.4T总参数的硬件部署门槛。此前有报道称阿里正研究对基于旗舰模型运营大规模商用服务的企业引入分成机制,相关条款将直接影响企业的部署决策,建议关注魔搭社区后续的许可协议与部署文档。

