返回热力追踪
关键Model Opensource

阿里发布2.4T参数最大开放权重Qwen3.8-Max,英伟达GB300支持部署推理

阿里巴巴发布其最大开放权重大模型Qwen3.8-2.4T-A95B(Qwen3.8-Max),总参数2.4T,单token激活95B,为MoE架构。该模型支持混合注意力,上下文窗口达100万token,适配复杂推理与代理式工作负载,可在NVIDIA GB300 NVL72平台部署服务。

编辑视角

这是当前开源生态中参数规模接近前沿闭源模型的开放权重大模型,验证了大参数MoE模型在数据中心加速计算平台的可部署性,对开源大模型生态和推理部署方案都有重要参考价值。

深度解读

本次事件核心是阿里巴巴开放其最大参数量的Qwen3.8-Max模型权重,该模型采用精细MoE架构,兼顾大上下文与长输出能力,英伟达公开了该模型在自家GB300 NVL72平台的部署方案,打通了大参数开放模型从发布到落地推理的技术链路。目前公开信息已确认模型参数架构、核心特性与部署平台,内容可验证。该信号的边界在于,当前仅确认模型权重开放和部署方案公开,尚未披露具体的下游任务性能数据、实际业务落地案例,也未提供公开可访问的部署Demo体验入口,实际推理性能表现仍需后续实测验证。后续需要观察模型实际性能表现、开源社区采用情况,以及更多硬件平台的适配进展。

核心要点
  • 阿里巴巴发布旗下最大开放权重模型Qwen3.8-Max
  • 模型总参数2.4T,单token激活95B,支持百万token上下文
  • 可在NVIDIA GB300 NVL72平台完成部署推理
  • 为开放生态带来接近前沿水平的大模型能力