资讯

千问Qwen 3.8 Max-0902版发布:1个月时间内代码能力暴涨 超越Opus5

驱动之家·2026/9/2 06:22:00🔗 原文

📌 概要

阿里9月2日发布Qwen 3.8 Max-0902版,与8月版同底座,参数2.4万亿、上下文100万,重点升级Coding与Cowork后训练,编程能力一个月内成倍提升,多项基准超越Opus5,价格维持不变。

⚡ 关键要点

  • Qwen 3.8 Max-0902上线QwenCloud API,价格不变:输入2美元、输出6美元/百万Token
  • 重点强化编程、复杂工作流与长时间Agent任务,TerminalBench 3.0从11.3涨至29.0
  • DeepSWE 1.1从56.6涨至69.3,QwenSWEbench V2从55.1涨至70.0,代码能力超越Opus5

快科技9月2日消息,这一天内又有多个大模型发布,除了Fable 5.1/Mythos 5.1之外,谷歌的Gemini 3.8 Flash也发了,阿里也发了Qwen 3.8 Max-0902,一个月时间内编程性能成倍增长。

Qwen3.8-Max-0902现已上线QwenCloud API,价格保持不变,仍为输入2美元、输出6 美元/百万Token,升级不加价好评。

Qwen 3.8 Max-0902跟8月发布的Qwen 3.8 Max是同一个底座大模型,依然是2.4万亿参数量,100万上下文,升级重点则是Coding和Cowork后训练,重点提升编程、复杂工作流和长时间Agent任务能力。

千问官方也公布了最新的性能基准,在Coding编程任务中8项任务全面提升,部分任务提升非常明显,TerminalBench 3.0从11.3涨到29.0,DeepSWE 1.1从56.6涨到69.3,QwenSWEbench V2从55.1涨到70.0。职业任务JobBench也从53.4涨到64.0。

Agent及多模态任务上的性能也有一定提升,不过跟之前的版本变化不是很大。

千问Qwen 3.8 Max-0902版发布:1个月时间内代码能力暴涨 超越Opus5

在Code Arena的WebDev评测中,Qwen 3.8 Max-0902以1691分的性能登顶第一,超过了Opus5等美国顶级大模型。

千问Qwen 3.8 Max-0902版发布:1个月时间内代码能力暴涨 超越Opus5

千问Qwen 3.8 Max-0902版发布:1个月时间内代码能力暴涨 超越Opus5