阿里巴巴 Qwen 团队在 Qwen 4 正式发布前,先向开发者放出一个预览版本。根据 Hugging Face 官方页面,阿里于 8 月 26 日发布开源模型 Qwen3.8-Flash-Next,官方将其定位为「Qwen 4 架构的预览」,让外界能在完整 Qwen 4 家族推出前,先体验新一代架构。
采用 125B MoE 架构,每个 token 约启用 6B 参数
根据团队披露的信息,Qwen3.8-Flash-Next 是一款采用混合专家(MoE)架构的开源多模态模型,总参数约 1,250 亿(125B),每个 token 仅启用约 60 亿(6B)参数。这种设计的目标,是在保留大模型知识量的同时,降低实际推理成本。
模型权重已经上线 Hugging Face,且计划同步上线中国的 ModelScope 平台,开发者无需依赖专有 API 即可使用。
作为 Qwen 4 预览版本,官方尚未公布基准成绩
这次发布的重点不只在单一模型本身,还在于它是新一代 Qwen 4 架构首个对外发布的版本,目的是让开发者提前熟悉,并为后续迁移做准备。
需要注意的是,阿里目前尚未公布 Qwen3.8-Flash-Next 的基准测试成绩,文中提到的参数规格也还没有经过独立验证,实际性能仍有待完整评测。
阿里近期持续推进开源节奏
ABMedia 提到,阿里近期的开源动作较为密集,8 月中旬才推出可在笔记本电脑运行的较小型 Qwen 3.8-27B,如今再以 Flash-Next 率先亮相,也让 Qwen 4 的竞争态势提前浮上台面。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

