-
游戏榜单
- 1.
schooldays
- 2.
死亡公园2内置菜单
- 3.
我的妹妹制造ex手机版
- 4.
植物大战僵尸杂交版2.0
- 5.
无耻乱斗2
- 6.
解忧小村落折相思
- 7.
楼下的早餐店最新版
- 8.
脑洞汉字王免广告
关闭导航
热搜榜
千问Qwen 3.8 Max-0902版发布:1个月内代码能力大幅提升,超越Opus5
小编:一二三游戏网 时间:2026-09-02 16:04:22
9月2日消息,这一天内又有多个大模型发布,除了<strong>Fable 5.1</strong>和<strong>Mythos 5.1</strong>之外,谷歌的<strong>Gemini 3.8 Flash</strong>也发布了,阿里则推出了<strong>Qwen 3.8 Max-0902</strong>,在一个月的时间内,编程性能实现了成倍增长。
Qwen3.8-Max-0902现已上线QwenCloud API,价格保持不变,仍为输入2美元、输出6 美元/百万Token,升级不加价好评。
Qwen 3.8 Max-0902跟8月发布的Qwen 3.8 Max是同一个底座大模型,依然是2.4万亿参数量,100万上下文,升级重点则是Coding和Cowork后训练,重点提升编程、复杂工作流和长时间Agent任务能力。
千问官方也公布了最新的性能基准,在Coding编程任务中8项任务全面提升,部分任务提升非常明显,TerminalBench 3.0从11.3涨到29.0,DeepSWE 1.1从56.6涨到69.3,QwenSWEbench V2从55.1涨到70.0。职业任务JobBench也从53.4涨到64.0。
Agent及多模态任务上的性能也有一定提升,不过跟之前的版本变化不是很大。

在Code Arena的WebDev评测中,Qwen 3.8 Max-0902以1691分的性能登顶第一,超过了Opus5等美国顶级大模型。


相关阅读 更多 +
排行榜 更多 +

















