阿里放出 Qwen3.8-Max-0902,CodeArena 前端编程总榜 1691 分,第一。
这个 0902 是在原来的 Qwen3.8-Max 上继续做后训练的结果,方向是编程和专业办公任务。相比旧版涨了 22 分——旧版此前排在全球第四,1668 分档位。22 分在这种榜单上不是小数目,前几名之间往往就差十几分。
模型规格延续 Max 这一档:2.4 万亿总参数的稀疏 MoE,推理时激活约 950 亿,上下文 1M。
真正让这条消息有分量的是价格。API 每百万 tokens 输入 2 美元、输出 6 美元,综合均价 5 美元左右。榜单第二、第三名对应的数字分别是 20 和 12 美元。同一张榜的前三名,最贵的是最便宜的四倍。
已经接进了千问 AI 平台、千问办公、Qoder 和千问 App。
前端编程榜有它自己的脾气,Arena 类的盲测榜单本质上测的是”人类评审更喜欢哪个输出”,跟”这段代码上线之后会不会出事”是两回事。1691 分能说明它写出来的东西好看、符合预期,不能直接推出它更能扛复杂工程。想验这一点,还得看 SWE-bench 这类要跑通测试用例的榜。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






Qwen3.8-Max-0902 拿下 CodeArena 前端第一,均价 5 美元,第二名 20 美元