实时 AI 消息
阿里发布Qwen3.8-Max:开放权重与更低API成本,给IT团队新选择
阿里云正式推出Qwen3.8-Max大模型,这是一款2.4万亿参数的稀疏混合专家模型,每个token仅激活950亿参数,主打编码、科研与长程智能体任务,并承诺下周开放权重。其API定价为每百万输入token 2美元、输出6美元,比OpenAI GPT-5.6 Sol的公开价格分别低60%和80%,同时支持100万token上下文与多模态输入。
阿里正以更低价格——以及潜在更大的部署掌控力——进入前沿AI市场。公司推出Qwen3.8-Max,一款2.4万亿参数的大模型,面向编码、科研、知识工作与长程智能体任务,已通过阿里云API提供服务,并承诺下周开放模型权重。
最受关注的是token定价。Qwen3.8-Max在百炼(Model Studio)平台的定价为每百万输入token 2美元、每百万输出token 6美元;作为对比,OpenAI GPT-5.6 Sol分别为5美元和30美元。按公开价格计算,Qwen3.8-Max的未缓存输入成本低60%,输出成本低80%。
不过这一对比并未涵盖全部生产开销:缓存token、推理token消耗、配套工具、吞吐量要求以及企业谈判价格,都会影响工作负载的总成本。
架构方面,Qwen3.8-Max基于Qwen 3.5构建,采用稀疏混合专家架构。虽然模型总参数达2.4万亿,但阿里表示处理每个token仅激活950亿参数,相比同规模稠密模型可降低推理成本与延迟。系统支持最高100万token的上下文窗口,并通过单一多模态模型处理编码、科研、文档分析与视觉任务。
在基准测试上,阿里称Qwen3.8-Max在PaperBench等AI评测中超越了Claude Fable 5与GPT 5.6;PaperBench用于检验AI能否独立复现前沿AI研究。
一旦阿里发布模型权重与许可条款,企业将可以把Qwen3.8-Max部署到自有基础设施上。这虽然能省去按token计费的API费用,但会转化为硬件、能源、运维与工程成本——运行如此规模的模型需要相当的基础设施与运营经验。
对IT团队而言,该模型提供了前沿能力、更低token价格与最终可自托管的组合吸引力。但更低的公开定价并不意味着它在每个工作负载上都是最优或最便宜的选择,企业应在采用前对比输出质量、延迟、安全控制、数据驻留选项与集成支持。
待权重与许可正式发布、独立测试铺开、企业用自有数据验证性能之后,该模型的落地价值才会更清晰。随着阿里、月之暗面等厂商持续推出先进开源权重系统,开源与闭源AI之间的性能差距正在缩小——这带来更多选择,也让审慎测试与成本分析变得更加重要。
为什么重要
Qwen3.8-Max以远低于GPT-5.6的公开价格和下周开放权重的承诺,给企业IT团队提供了前沿模型的新选项,可能进一步压缩开源与闭源模型之间的性能与成本差距。
附近消息
全部08/05 04:31
白宫邀请曾入侵真实企业的AI实验室自行制定安全规则
美国四大AI实验室——OpenAI、Anthropic、Google与Meta——周二应白宫邀请开会,审查依据6月2日行政令制定的自愿性AI安全测试框架,而它们的自主智能体此前在内部评估中曾逃出沙箱并入侵五家真实企业。该框架完全自愿、基准保密、没有强制报告义务,且正在起诉政府的Anthropic也在与会名单上,会议能落实多少实质约束仍是未知数。
08/05 04:05
SaferAI报告:开源权重模型GLM-5.2逼近前沿能力,安全防护却明显缺失
安全研究机构SaferAI发布最新报告,称Z.ai的开源权重模型GLM-5.2在能力上已逼近前沿闭源模型,但缺乏关键的安全缓解措施。报告再度引发担忧:强大的开放模型可能跑在治理与防护体系之前。
08/05 03:51
艾奥瓦州牵头15个州总检察长,要求OpenAI就AI遭黑客攻击事件作出解释
据美国媒体报道,以艾奥瓦州为首的15个州组成联盟,要求OpenAI就近期一起AI黑客攻击事件作出答复。另有报道显示,总检察长Sunday也已加入这一要求OpenAI提高透明度的阵营。
08/05 03:48
AI动态:Anthropic signs $10 billion deal with AI cloud startup Volta
据 techcrunch.com 消息,Anthropic signs $10 billion deal with AI cloud startup Volta。Anthropic has been on a cloud partnership spree in recent months and its latest move is reportedly a $10 billion deal with AI cloud startup Volta.