编程评测全面上涨,部分超越Claude Opus 5
阿里公布的对比表显示,0902在8项编程评测上全部高于原版。TerminalBench 3.0从11.3涨至29.0,DeepSWE 1.1从56.6涨至69.3,QwenSWEbench V2从55.1涨至70.0。职业任务JobBench也从53.4涨至64.0。与Claude Opus 5相比,0902在多数编程项目上仍处劣势,但在MLS-Bench-Lite、SWE-Atlas QnA和QwenSWEbench V2三项测试中反超对手。多模态小幅提升,Agent能力成核心
多模态四项相比原版仅上涨0.4到3分,显示本轮升级重点在于让Agent更善于写代码和执行复杂任务。上述成绩均为阿里自测,尚未经第三方验证。已上线API,价格不变
Qwen3.8-Max-0902现已上线QwenCloud API,价格维持原标准:输入2美元、输出6美元/百万Token。本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

