Qwen3.8-Max-0902 拿下 CodeArena 前端第一,均价 5 美元,第二名 20 美元

AI头条17分钟前发布 Ferris
693 0

阿里放出 Qwen3.8-Max-0902,CodeArena 前端编程总榜 1691 分,第一。

这个 0902 是在原来的 Qwen3.8-Max 上继续做后训练的结果,方向是编程和专业办公任务。相比旧版涨了 22 分——旧版此前排在全球第四,1668 分档位。22 分在这种榜单上不是小数目,前几名之间往往就差十几分。

模型规格延续 Max 这一档:2.4 万亿总参数的稀疏 MoE,推理时激活约 950 亿,上下文 1M。

真正让这条消息有分量的是价格。API 每百万 tokens 输入 2 美元、输出 6 美元,综合均价 5 美元左右。榜单第二、第三名对应的数字分别是 20 和 12 美元。同一张榜的前三名,最贵的是最便宜的四倍。

已经接进了千问 AI 平台、千问办公、Qoder 和千问 App。

前端编程榜有它自己的脾气,Arena 类的盲测榜单本质上测的是”人类评审更喜欢哪个输出”,跟”这段代码上线之后会不会出事”是两回事。1691 分能说明它写出来的东西好看、符合预期,不能直接推出它更能扛复杂工程。想验这一点,还得看 SWE-bench 这类要跑通测试用例的榜。

© 版权声明

相关文章

Qwen3.8-Max-0902 拿下 CodeArena 前端第一,均价 5 美元,第二名 20 美元 暂无评论

none
暂无评论...