实时 AI 消息
阿里更新旗舰模型Qwen3.8-Max:CodeArena前端编程得分1691,登顶全球第一
9月2日,阿里更新旗舰模型Qwen3.8-Max,针对编程与专业办公进行专项后训练,使其在CodeArena前端编程(WebDev)榜单上提升22分至1691分,超越Claude Opus 5、Kimi K3登顶全球第一。新版每百万Tokens综合平均成本约5美元,已上线千问AI平台API,千问办公、Qoder与千问APP同步接入。
9月2日,阿里更新旗舰模型Qwen3.8-Max,性能较旧版本显著提升。据阿里方面介绍,Qwen3.8-Max是千问迄今最强大的大语言模型,总参数达2.4万亿,支持100万上下文Token;本次更新针对编程(Coding)与专业办公(Cowork)进行了专项后训练。
更新最直观的成果体现在榜单上:在聚焦前端编程能力(WebDev)的全球权威三方榜单CodeArena中,新版本得分提升22分至1691分,领先Claude Opus 5、Kimi K3等一众模型,位居总榜第一。
价格同样是这次更新的卖点。CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均仅约5美元,低于榜单上所有定价超过5美元的模型。
阿里称,更新后的Qwen3.8-Max涌现出更强的智能体编程能力,更适合企业真实复杂任务、科研以及长周期任务等场景。
目前,Qwen3.8-Max新模型已上线千问AI平台对外提供API服务,千问办公、Qoder、千问APP均已在第一时间接入。
前端编程已成为大模型竞赛最拥挤的赛道之一,阿里这次同时押注榜单成绩与价格优势。接下来值得关注的是,1691分的CodeArena成绩能否转化为真实企业项目中的体验优势,以及Claude Opus 5、Kimi K3等对手会如何回应。
为什么重要
阿里用编程与办公专项后训练把旗舰模型推向前端编程榜首,并以约5美元/百万Token的定价卡位,直接对标Claude Opus 5、Kimi K3等高价模型;后续真实编码体验与对手跟进将决定这一领先能否持续。
附近消息
全部09/02 14:10
阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一
9月2日,阿里更新旗舰模型Qwen3.8-Max,针对编程与专业办公进行专项后训练,性能较旧版本显著提升。新版本在聚焦前端编程能力的第三方榜单CodeArena中提升22分至1691分,超越Claude Opus 5、Kimi K3等竞品,位居总榜第一。
09/02 14:06
前字节强化学习专家孙鹏博士加盟星尘智能,补齐Physical AI全栈技术布局
量子位9月2日报道,前字节跳动强化学习专家、前腾讯Robotics X智能体中心负责人孙鹏博士正式加入星尘智能。这家聚焦Physical AI的公司正借此完善全栈技术布局,强化学习大将的加盟被视作补齐关键拼图的一步。
09/02 14:05
OpenAI 与 Anthropic 也加入抢购:苹果 Mac mini 成 AI 行业最青睐硬件
据财联社报道,OpenAI 与 Anthropic 也加入了抢购苹果 Mac mini 的行列,这款桌面电脑已成为 AI 行业最受青睐的硬件设备。报道未披露具体采购规模,但头部实验室的硬件选择正在释放算力策略多元化的信号。
09/02 14:20
蚂蚁拿下VLDB 2026工业赛道最佳论文:OmniTable统一宽表处理35PB语料,效率提升5.6倍
据量子位报道,蚂蚁集团自研的统一宽表系统OmniTable获评VLDB 2026工业赛道最佳论文,让大模型数据工程再次成为行业焦点。这套系统以一套宽表方案处理35PB级语料,报道称处理效率较以往流程提升5.6倍。