Qwen3.8-Max-0902 登顶 Code Arena:2.4T 参数、1M 上下文、$5/MToken 领跑性价比前沿
事件背景
通义千问(Qwen)与阿里云于 9 月 2 日先后宣布,Qwen3.8-Max 升级为 Qwen3.8-Max-0902:参数量 2.4T,上下文窗口扩展至 1M token,针对编码与协作(Coding & Cowork)进行了进一步后训练,面向复杂企业任务、科学研究和长程工作流。模型已通过 QwenCloud API 上线,可在 QwenCloud 试用。
榜单成绩
| 模型 | Code Arena: WebDev |
|---|---|
| Qwen3.8-Max-0902 | 1691(首次亮相即总榜第一,较前代 +22) |
| Claude Opus 5 (Max) | 1688 |
| Kimi K3 (Max) | 1674 |
| 上一版 Qwen3.8-Max | 1669 |
定价:两条口径
- 官方口径:以 $5/MToken 混合价成为 Pareto 前沿上得分最高的模型。
- 第三方口径:Kim 的报道给出每 1M tokens 定价 $2 输入 / $6 输出,缓存命中 $0.17 / $0.25。
时间线要点
- 9 月 2 日 02:07:通义千问官宣升级——2.4T 参数、1M token 上下文、Coding & Cowork 后训练。
- 03:07-03:29:官方公布 Code Arena 1691 分登顶与 Pareto 前沿定价;IT之家跟进「前端编程总榜 +22 分夺冠」。
- 07:59-08:08:阿里云公布与 Claude Opus 5、Kimi K3 的分差;Kim 披露详细定价。
编辑部的看法
把三件事放在一起看:登顶编码榜、1M 上下文、$5/MToken 的混合价——Qwen 在用「旗舰能力 + 平价」的组合拳直接挤压海外头部模型的性价比区间。对做编码智能体和企业长流程应用的团队,值得用自有工作负载实测一轮:榜单分数与你的真实任务分布之间,永远隔着一条需要自己校准的曲线。
数据来源与原文出处
数据来源:AIHOT(热点聚合时间线)
- 通义千问:升级官宣 / 登顶与定价推文
- 阿里云:参数与上下文推文 / 登顶推文
- Kim:基准对比与定价推文
- 阿易 AI Notes:登顶 CodeArena 推文
- IT之家:阿里千问发布 Qwen3.8-Max-0902 版本,登顶 CodeArena 前端编程总榜
—— 完 ——