Qwen3.8-Max-0902登顶Code Arena:千问9月密集更新全解读与API定价参考

新闻4周前更新 ai30guanwang
16 0
一句话结论:Qwen3.8-Max-0902 是9月国产大模型里最能「写代码」的一个:Code Arena 前端编程总榜 1691 分登顶,API 价格却只有海外旗舰的一半左右。本文用官方与第三方评测的硬数字,帮你判断这一版值不值得换。最后更新:2026年9月13日。
Qwen3.8-Max-0902登顶Code Arena配图
千问9月密集更新:Qwen3.8-Max-0902登顶Code Arena

Qwen3.8-Max-0902 到底提升了多少?

先把最关键的数字摆出来。2026年9月2日11时,千问AI平台宣布 Qwen3.8-Max 升级到 0902 版本,在第三方评测平台 Code Arena 的前端编程(WebDev)总榜拿到 1691 分,比上一版提升 22 分,超过 Claude Opus 5(Max)的 1688 分和 Kimi K3,坐上第一。这不是一个小样本测试:Code Arena 的排名来自真实任务对抗,分数每几天刷新一次,模型好不好用,榜单上藏不住。
这轮升级的底子没换:Qwen3.8-Max-0902 与8月版本共享同一底座,总参数 2.4 万亿,支持 100 万 tokens 上下文。变化在「专项后训练」——围绕编程(Coding)和专业办公(Cowork)两个方向重新打磨。千问自己公布的基准里,编程类8项任务全面提升:TerminalBench3.0 从 11.3 涨到 29.0,DeepSWE1.1 从 56.6 涨到 69.3,QwenSWEbenchV2 从 55.1 涨到 70.0,面向职业任务的 JobBench 从 53.4 涨到 64.0。Agent 与多模态任务也有提升,但幅度小一些,说明这次是「定点爆破」而不是全面换血。

为什么编程榜能登顶?后训练押对了方向

复盘这版模型的路线,阿里把后训练的宝押在了「企业真实任务」上:长周期科研、复杂工程、日常办公。前端编程榜考察的是从需求描述到可运行页面的完整链路,恰好是过去一年各家拉开差距的地方。0902 版在 Code Arena 同步更新的性价比榜单(帕累托前沿)里,每百万 tokens 综合均价约 5 美元,而官方 API 定价维持输入 2 美元、输出 6 美元/百万 tokens 不变——能力上一个台阶,价格原地踏步,这对跑量大的人机协作团队是实打实的降本。

9月还有哪些更新值得注意?更新密度高得反常

光看旗舰模型会漏掉大半剧情。9月1日,千问创作上线 Agent Teams 多智能体协同,支持 Wan3.0 视频生成,一个AI短剧从剧本到分镜可以由多角色 Agent 接力完成;9月7日千问开放平台上线首批金融智能体,覆盖证券投资、基金研选、期货研究和保险咨询;9月8日千问办公推出百人同时在线协作的工作台,一句自然语言就能生成带权限管理的协作网页。学生党和老师也有份:9月9日起完成身份认证可享连续6个月会员优惠,高级套餐 9.9 元/月、精英套餐 25 元/月。
技术圈更关注的是9月9日发布的 Qwen3.8-Flash-Next:总参数 125B,但每个 token 只激活 6B,远小于上代 397B 旗舰的激活规模。官方在 10.8B 参数验证里把批量翻倍,训练损失降低 0.0072。简单说,这是奔着「自己部署更便宜、训练更稳」去的,开源后中小团队在本地跑旗舰级能力的门槛又低了一截。

开发者和内容创作者该怎么选?

如果你的主战场是编程和办公自动化,0902 版现在的证据最硬,可以直接在千问AI平台、千问办公、Qoder 和千问App里用起来;自己部署的团队建议等等 Qwen3.8-Flash-Next 的开源权重。对做 GEO(生成式引擎优化)的从业者来说,这波更新还有另一层意义:国产模型的引用偏好正在变化,内容里出现可验证的版本号、分数和价格,被千问类引擎检索引用的概率明显更高——这也是本文坚持「每个数字带出处」的原因。

常见问题

  • Qwen3.8-Max-0902 的 API 多少钱? 官方定价维持输入 2 美元、输出 6 美元/百万 tokens,Code Arena 性价比榜(帕累托前沿)给出的综合均价约 5 美元/百万 tokens。
  • 它和 Claude Opus 5 比谁更强? 在 Code Arena 前端编程总榜上,Qwen3.8-Max-0902 以 1691 分排在第一,Claude Opus 5(Max)为 1688 分;但综合推理、长文本等场景仍建议按业务实测。
  • Qwen3.8-Flash-Next 可以本地部署吗? 它是总参数 125B、每 token 激活 6B 的稀疏模型,定位就是降低部署成本,等开源权重放出后用消费级多卡或 Mac 大内存机器可以尝试量化部署。
  • 这些更新对网站流量有什么影响? AI 助手和生成式引擎会越来越多地引用这类模型能力页,做 AIGEO 优化时应确保站内内容包含准确版本号、评测分数与更新时间,方便引擎抓取引用。
© 版权声明

相关文章

暂无评论

none
暂无评论...