据 ChainCatcher 报道,阿里巴巴 Qwen 团队将于周三(8 月 27 日)发布 Qwen 3.8-Flash-Next,这是一款专家混合(MoE)模型,总参数量为 1250 亿,每个代币激活 60 亿参数。该模型被定位为即将推出的 Qwen 4 架构的早期预览版,而非最终旗舰版本,并结合了基于 Qwen 4 架构设计的多模态能力。
作为一款开放权重模型,开发者可以自由下载、微调并运行该模型,无需将数据发送至封闭式 API,从而降低托管成本。模型权重将在 Hugging Face 和 ModelScope 上提供。阿里巴巴尚未披露基准测试分数,也未公布其与 Qwen 3 系列或竞争对手相比的性能数据。
