阿里巴巴 Qwen 团队计划于周三发布 Qwen 3.8-Flash-Next,并将其定位为下一代 Qwen 4 架构的预览版,而非完整旗舰模型。现阶段披露的重点在于架构方向和参数设计,性能成绩尚未同步公开。
1250亿总参数,单次仅激活60亿
根据预发布说明,这一模型采用总计 1250 亿参数的设计,但每个 token 仅激活 60 亿参数。Qwen 团队将其描述为多模态模型,并表示提前放出早期版本,是为了让开发者先行适配后续完整的 Qwen 4 系列。
从现有信息看,这一模型大概率采用混合专家架构,也就是将不同能力拆分到多个子模型中,推理时只调用与当前任务相关的部分。这样可以在维持较大模型规模的同时,降低单次运行所需算力。
定位不是正式旗舰
Qwen 团队和 Hugging Face 对这一版本的表述都更接近“预览版”。这意味着此次发布的重点,不是直接给出完整一代新模型,而是先把部分架构改进提前交付,让开发者为后续正式版本做准备。
“3.8”这一命名也反映出它更像是过渡版本,而不是 Qwen 4 的正式落地。文章称,团队当前更强调新架构方向,而不是把这次更新包装成一次完整换代。
基准测试仍未公布
截至发稿,Qwen 尚未公布与自家 Qwen 3 系列或海外主流模型的对比成绩,模型权重也还未在 ModelScope 上线。因此,外界目前只能依据团队披露的参数信息判断其潜在能力,实际表现仍有待验证。
文章提到,近一段时间中国开源模型发布节奏持续加快。阿里巴巴、DeepSeek 和 Moonshot 等团队都在持续推出可下载、可微调、可本地运行的开放权重模型。若 Qwen 这次按计划发布,一个总参数 1250 亿、激活参数 60 亿的开放模型,可能进一步压低开发者使用高性能模型的门槛。












