郭震 AI公众号:郭震AI

实时 AI 消息

阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一

9月2日,阿里更新旗舰模型Qwen3.8-Max,针对编程与专业办公进行专项后训练,性能较旧版本显著提升。新版本在聚焦前端编程能力的第三方榜单CodeArena中提升22分至1691分,超越Claude Opus 5、Kimi K3等竞品,位居总榜第一。

发布时间

9月2日,阿里更新旗下旗舰大模型Qwen3.8-Max,官方称性能较旧版本显著提升。新版模型已上线千问AI平台对外提供API服务,千问办公、Qoder、千问App均第一时间完成接入。

此次更新的关键在于针对编程(Coding)与专业办公(Cowork)两大场景进行了专项后训练,使新版本整体能力进一步增强。官方表示,更新后的模型面向企业真实复杂任务、科研与长周期任务时,具备更强的智能体编程能力。

最能体现变化的是榜单成绩。在聚焦前端编程能力(WebDev)的全球权威第三方榜单CodeArena中,Qwen3.8-Max新版本提升22分至1691分,领先Claude Opus 5、Kimi K3等一众模型,位居总榜第一。

除了硬性分数,新版在成本维度也极具冲击力。CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均仅5美元,直接“斩杀”所有价格高于5美元的竞品模型。

就模型本身而言,Qwen3.8-Max是阿里千问迄今最强大的大语言模型,总参数达2.4万亿,支持100万上下文Tokens。超大参数规模与长上下文窗口的组合,为其处理复杂编程与办公任务提供了基础。

从榜单对手看,Claude Opus 5与Kimi K3均为当前编程能力领先的模型,Qwen3.8-Max此次登顶,意味着阿里旗舰模型在前端与智能体编程领域已具备直接对标国际头部产品的能力。

接下来值得关注的是新版在实际企业任务中的落地反馈,以及阿里是否会延续更新节奏,把这一代模型的能力拓展到更多编程与办公基准上。

为什么重要

Qwen3.8-Max在CodeArena登顶,标志着阿里在前端与智能体编程上进入全球第一梯队,同时以每百万Tokens约5美元的定价强化性价比竞争,可能进一步挤压海外旗舰模型的定价空间。

微博邮件

AlibabaQwen3.8-MaxModel Update
返回实时消息

附近消息

全部