阿里千问再升级:Qwen3.8-Max-0902编程能力全面提升,部分超越Claude Opus 5

阿里千问再升级:Qwen3.8-Max-0902编程能力全面提升,部分超越Claude Opus 5

N
News Editor
2026-09-02 02:56:43
阿里千问将旗舰模型Qwen3.8-Max升级至0902版本,参数规模保持2.4T,上下文100万Token。重点补强编程与Agent能力,8项编程评测全部上涨,TerminalBench从11.3涨至29.0,DeepSWE从56.6涨至69.3。其中MLS-Bench-Lite、SWE-Atlas QnA和QwenSWEbench V2三项超越Claude Opus 5。多模态小幅提升0.4-3分。新模型已上线API,价格不变。
阿里千问近日将旗舰模型Qwen3.8-Max升级至0902版本,新模型编号为Qwen3.8-Max-0902。参数规模仍为2.4T,上下文窗口保持100万Token。此次升级重点聚焦Coding与Cowork后训练,意在提升编程、复杂工作流及长时间Agent任务的表现。



编程评测全面上涨,部分超越Claude Opus 5

阿里公布的对比表显示,0902在8项编程评测上全部高于原版。TerminalBench 3.0从11.3涨至29.0,DeepSWE 1.1从56.6涨至69.3,QwenSWEbench V2从55.1涨至70.0。职业任务JobBench也从53.4涨至64.0。与Claude Opus 5相比,0902在多数编程项目上仍处劣势,但在MLS-Bench-Lite、SWE-Atlas QnA和QwenSWEbench V2三项测试中反超对手。

多模态小幅提升,Agent能力成核心

多模态四项相比原版仅上涨0.4到3分,显示本轮升级重点在于让Agent更善于写代码和执行复杂任务。上述成绩均为阿里自测,尚未经第三方验证。

已上线API,价格不变

Qwen3.8-Max-0902现已上线QwenCloud API,价格维持原标准:输入2美元、输出6美元/百万Token。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
500

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。