返回热力追踪
关注Model Opensource

阿里开源Qwen3.8-Flash-Next 176B 为Qwen4架构做技术预览

阿里巴巴发布Qwen3.8-Flash-Next 176B模型权重,作为下一代Qwen4架构的预览版本开放开发者体验。该模型已在Hugging Face与魔搭社区开源,适配NVIDIA GB300 NVL72硬件做智能体编码实验。

编辑视角

作为Qwen4架构的先行预览版,该模型带来训练推理成本大幅下降的优化,落地智能体编程场景,对开源大模型生态和开发者实践都有参考价值,值得关注进展。

深度解读

本次公开的Qwen3.8-Flash-Next 176B是Qwen4全新架构的预览版本,阿里已经将模型权重在Hugging Face与魔搭社区开源,面向全球开发者开放验证。该模型主打训练与推理成本优化,推理成本仅为Claude Opus4.6的3%,优化方向聚焦智能体编程、日常办公等场景,千问办公标准模式已经内置相关版本。NVIDIA开发者博客也同步放出了在GB300 NVL72硬件上运行该模型做智能体编码实验的指南。

证据边界:当前仅为Qwen4架构的预览实验版本,未发布正式版Qwen4,公开信息中尚未披露完整技术论文与全系列产品规划,仅披露了176B参数版本的预览权重,更大参数版本的Qwen3.8-Max已单独发布。后续需关注Qwen4正式架构的发布与全系列开源进展。

核心要点
  • 阿里开源Qwen3.8-Flash-Next 176B,为Qwen4架构做预览
  • 模型训练成本下降90%,推理成本仅为Claude Opus4.6的3%
  • 已适配NVIDIA GB300 NVL72做智能体编码实验
  • 权重已开源至Hugging Face与阿里魔搭社区
延伸阅读
  • Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72同系列更大参数Qwen模型的部署方案,关联参考