Qwen3.8-Max-0902 登顶 Code Arena:2.4T 参数、1M 上下文、$5/MToken 领跑性价比前沿

精益前沿编辑部编辑于 2026-09-04
496 次阅读

事件背景

通义千问(Qwen)与阿里云于 9 月 2 日先后宣布,Qwen3.8-Max 升级为 Qwen3.8-Max-0902:参数量 2.4T,上下文窗口扩展至 1M token,针对编码与协作(Coding & Cowork)进行了进一步后训练,面向复杂企业任务、科学研究和长程工作流。模型已通过 QwenCloud API 上线,可在 QwenCloud 试用。

榜单成绩

模型Code Arena: WebDev
Qwen3.8-Max-09021691(首次亮相即总榜第一,较前代 +22)
Claude Opus 5 (Max)1688
Kimi K3 (Max)1674
上一版 Qwen3.8-Max1669

定价:两条口径

  • 官方口径:以 $5/MToken 混合价成为 Pareto 前沿上得分最高的模型。
  • 第三方口径:Kim 的报道给出每 1M tokens 定价 $2 输入 / $6 输出,缓存命中 $0.17 / $0.25。

时间线要点

  • 9 月 2 日 02:07:通义千问官宣升级——2.4T 参数、1M token 上下文、Coding & Cowork 后训练。
  • 03:07-03:29:官方公布 Code Arena 1691 分登顶与 Pareto 前沿定价;IT之家跟进「前端编程总榜 +22 分夺冠」。
  • 07:59-08:08:阿里云公布与 Claude Opus 5、Kimi K3 的分差;Kim 披露详细定价。

编辑部的看法

把三件事放在一起看:登顶编码榜、1M 上下文、$5/MToken 的混合价——Qwen 在用「旗舰能力 + 平价」的组合拳直接挤压海外头部模型的性价比区间。对做编码智能体和企业长流程应用的团队,值得用自有工作负载实测一轮:榜单分数与你的真实任务分布之间,永远隔着一条需要自己校准的曲线。

数据来源与原文出处

数据来源:AIHOT(热点聚合时间线)

—— 完 ——