实时 AI 消息
阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一
9月2日,阿里更新旗舰模型Qwen3.8-Max,针对编程与专业办公进行专项后训练,性能较旧版本显著提升。新版本在聚焦前端编程能力的第三方榜单CodeArena中提升22分至1691分,超越Claude Opus 5、Kimi K3等竞品,位居总榜第一。
9月2日,阿里更新旗下旗舰大模型Qwen3.8-Max,官方称性能较旧版本显著提升。新版模型已上线千问AI平台对外提供API服务,千问办公、Qoder、千问App均第一时间完成接入。
此次更新的关键在于针对编程(Coding)与专业办公(Cowork)两大场景进行了专项后训练,使新版本整体能力进一步增强。官方表示,更新后的模型面向企业真实复杂任务、科研与长周期任务时,具备更强的智能体编程能力。
最能体现变化的是榜单成绩。在聚焦前端编程能力(WebDev)的全球权威第三方榜单CodeArena中,Qwen3.8-Max新版本提升22分至1691分,领先Claude Opus 5、Kimi K3等一众模型,位居总榜第一。
除了硬性分数,新版在成本维度也极具冲击力。CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均仅5美元,直接“斩杀”所有价格高于5美元的竞品模型。
就模型本身而言,Qwen3.8-Max是阿里千问迄今最强大的大语言模型,总参数达2.4万亿,支持100万上下文Tokens。超大参数规模与长上下文窗口的组合,为其处理复杂编程与办公任务提供了基础。
从榜单对手看,Claude Opus 5与Kimi K3均为当前编程能力领先的模型,Qwen3.8-Max此次登顶,意味着阿里旗舰模型在前端与智能体编程领域已具备直接对标国际头部产品的能力。
接下来值得关注的是新版在实际企业任务中的落地反馈,以及阿里是否会延续更新节奏,把这一代模型的能力拓展到更多编程与办公基准上。
为什么重要
Qwen3.8-Max在CodeArena登顶,标志着阿里在前端与智能体编程上进入全球第一梯队,同时以每百万Tokens约5美元的定价强化性价比竞争,可能进一步挤压海外旗舰模型的定价空间。
附近消息
全部09/02 14:10
阿里更新旗舰模型Qwen3.8-Max:CodeArena前端编程得分1691,登顶全球第一
9月2日,阿里更新旗舰模型Qwen3.8-Max,针对编程与专业办公进行专项后训练,使其在CodeArena前端编程(WebDev)榜单上提升22分至1691分,超越Claude Opus 5、Kimi K3登顶全球第一。新版每百万Tokens综合平均成本约5美元,已上线千问AI平台API,千问办公、Qoder与千问APP同步接入。
09/02 14:05
OpenAI 与 Anthropic 也加入抢购:苹果 Mac mini 成 AI 行业最青睐硬件
据财联社报道,OpenAI 与 Anthropic 也加入了抢购苹果 Mac mini 的行列,这款桌面电脑已成为 AI 行业最受青睐的硬件设备。报道未披露具体采购规模,但头部实验室的硬件选择正在释放算力策略多元化的信号。
09/02 13:57
南华早报:Hy4 预览版让腾讯重回开源 AI 第一梯队
南华早报发文分析称,腾讯的 Hy4 预览版让这家中国科技巨头重新回到开源 AI 的第一梯队。报道认为,这次发布代表了腾讯在开源路线上重新发力,也意味着其模型在开源阵营中重新具备竞争力。
09/02 13:33
OpenAI 发布超强模型 Astra:能力评估超标,已启动最高安全防护机制
OpenAI 推出全新 AI 模型 Astra,因能力评估超过安全阈值,公司启动了最高等级的安全防护机制。CoinDesk 援引 OpenAI 的说法报道,Astra 能够在没有人类协助的情况下自主构建网络攻击。