阿里巴巴 Qwen 团队于 8 月 14 日开源 Qwen 3.8-27B,并以 Apache 2.0 授权发布。这是一款多模态模型,支持商业使用。
约 278 亿参数,支持文本、图片与视频理解
依官方模型卡,Qwen 3.8-27B 具备约 278 亿参数,原生上下文窗口为 262,144 个 token,可延伸到 100 万,并支持文本、图片与视频理解。
文章称,这一量级的模型在量化后,高端笔记本或 Mac 也可以运行,呼应近期围绕“本地 AI”的讨论:把免费、可离线的模型直接部署到个人设备中。
官方对照中,部分项目分数高于 Claude Opus 4.6 Max
依 Qwen 官方模型卡对照,Qwen 3.8-27B 在部分程序与代理相关基准测试中的分数高于 Anthropic 的 Claude Opus 4.6 Max。
- SWE-bench Pro:61.7,对比 53.4
- LiveCodeBench v6:90.3,对比 88.8
- OSWorld-Verified:84.3,对比 72.7
- Terminal Bench 2.1:73.0,对比 78.2,低于后者
不过,文中也提醒,这组对照中 Claude Opus 4.6 Max 采用的是官方公布分数,而 Qwen 方面则是以 Claude Code 的测试框架评测,测试条件并不完全一致。这些数据目前仍属于厂商自报,尚待第三方验证。
与前代相比,代理与编程能力提升明显
与前一代 Qwen3.6-27B 相比,新版在代理和编程能力上的提升较为明显。以官方列出的数据看,OSWorld-Verified 从 63.9 提升到 84.3,DeepSWE 从 13.3 提升到 42.2。
ABMedia 文章认为,这延续了近期开源模型以较低成本逼近闭源前沿模型的趋势。文中同时提到,链新闻近日也曾报道 DeepSeek V4 Pro 以性价比对标 Claude。
在免费且可本地部署的前提下,这类模型如果能在部分任务上与头部闭源模型形成可比表现,也会给 OpenAI 与 Anthropic 的定价和护城河带来持续压力。

