返回行业动态
模型与产品

阿里首次开源Qwen-Max级模型权重:Qwen3.8-2.4T-A95B正式开放

8月12日深夜,阿里云魔搭ModelScope社区宣布,阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重,这是Qwen-Max级别旗舰模型首次开源权重。该模型为总参数2.4万亿的MoE稀疏架构,每个Token仅激活95B参数,原生支持262,144 Token上下文并可扩展至101万Token。官方云端版Qwen3.8-Max即基于该开放权重构建。此举标志着阿里旗舰级大模型首次向企业开放自主部署能力,对开源模型生态和企业AI基础设施选型具有重要影响。

来源:阿里云魔搭ModelScope社区原标题:千问3.8-2.4T-A95B查看原文
深蓝色科技背景上发光的AI芯片与神经网络节点,象征阿里千问Qwen3.8旗舰大模型开源

图片来源:北京拓实科技原创

发生了什么

8月12日深夜,阿里云魔搭ModelScope社区宣布,阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重。这是Qwen-Max级别模型首次开源权重,此前Qwen-Max系列旗舰模型仅通过云端API提供服务。模型页面已在魔搭社区上线,企业可自行下载部署。

模型规格与架构

  • Qwen3.8-2.4T-A95B为因果语言模型,总参数达2.4万亿,采用MoE稀疏架构,每个Token仅激活95B参数,推理成本显著低于稠密同规模模型
  • 每个MoE层包含512个专家,每个Token选择10个路由专家并同时激活1个共享专家
  • 原生支持262,144 Token上下文窗口,可扩展至1,010,000 Token,适配长文档与长周期智能体任务
  • 模型采用多步MTP(Multi-Token Prediction)训练,支持推理引擎一次预测多个后续Token,提升生成效率

行业意义

官方云端产品Qwen3.8-Max即基于该开放权重模型构建,并额外叠加了面向生产环境的能力。在官方评测中,模型覆盖编程智能体、通用智能体、专业工作与长上下文等方向,与Opus 4.8、Fable 5、GPT 5.6 Sol等模型相比互有高低,并在PaperBench、IFBench等基准上取得所列模型中的较高成绩。

对国内企业而言,Qwen-Max级模型权重的开放意味着可以在自有或私有化环境中部署此前仅能通过API调用的旗舰级模型,在数据合规、推理成本控制与二次微调方面获得更大灵活性。值得注意的是,近期DeepSeek V4 Pro正式版、Meta Muse Glimmer等开源模型密集发布,头部厂商正围绕开源权重展开新一轮生态竞争,企业在大模型选型时面临更多自主可控的选项。

尚待观察

目前官方尚未披露该模型的具体开源许可条款(是否允许商用、是否设置营收分成门槛)以及2.4T总参数的硬件部署门槛。此前有报道称阿里正研究对基于旗舰模型运营大规模商用服务的企业引入分成机制,相关条款将直接影响企业的部署决策,建议关注魔搭社区后续的许可协议与部署文档。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。