ChainCatcher 消息,阿里巴巴 Qwen 团队将于周三发布 Qwen 3.8-Flash-Next。该模型采用混合专家(MoE)架构,报道称其总参数为 1250 亿,但每个 token 仅激活 60 亿参数。
团队将这款模型定位为下一代 Qwen 4 架构的预览版本,不是最终旗舰模型。按披露信息,该模型为多模态,并基于即将推出的 Qwen 4 架构构建。
团队表示,之所以提前发布这一早期版本,是为了让开发者为后续完整的 Qwen 系列做好准备。模型权重将托管在 Hugging Face 和 ModelScope 平台。
截至目前,Qwen 尚未公布该模型的基准测试成绩,也没有发布其与自家 Qwen 3 系列或海外竞品的对比数据。报道还提到,1250 亿和 60 亿参数这组具体数字,目前尚未得到官方证实。
作为开放权重模型,开发者可以免费下载、微调并运行这款模型,无需将数据发送至封闭 API。按文中说法,这有助于降低托管模型的成本。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

