郭震 AI公众号:郭震AI

实时 AI 消息

千问办公首发上线Qwen3.8-Flash:生成速度提升100%,Token消耗减少75%

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,并同步推出标准模式,所有用户即日起可体验。官方测试显示,标准模式单任务生成速度提升约100%,Token消耗平均减少75%,未来95%的日常任务通过标准模式即可完成。

发布时间
千问办公首发上线Qwen3.8-Flash:生成速度提升100%,Token消耗减少75%
图源: github.com

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,并同步推出标准模式。即日起,所有用户都可以通过全新的标准模式体验Qwen3.8-Flash。

据量子位(获千问授权转载)报道,基于最新模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。千问办公表示,未来模型供给将只有标准和高级两种模式,95%的日常任务通过标准模式即可完成,仅5%的复杂任务需要使用高级模式。

体验提升来自模型升级与Agent协同优化。全新架构的Qwen3.8-Flash以千亿级总参数实现了超越Claude Opus 4.6的性能。

同时,千问大模型团队与千问办公团队联合推出了办公专属版本Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等场景进行专项训练调优,并通过推理优化和定制Harness架构进一步实现吞吐效率提升。

在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约100%,Token消耗平均减少75%。

报道指出,在真实AI应用场景中,高性能通常意味着高成本和高延迟,低成本则需要以牺牲智能为代价,而Agent与模型的深度协同优化正在打破性能、成本和速度的"不可能三角"。

随着模型智能密度的持续提升,以及千问办公与模型的双向优化,Agent有望告别Token焦虑。接下来值得关注的是标准模式与高级模式的分层定价落地,以及办公专属调优经验能否复制到更多垂直场景。

为什么重要

千问办公把前沿模型的成本与速度同时拉低,标准/高级双模式的设定可能重塑办公AI产品的定价与体验分层。

微博邮件

QwenAlibabaAgent
返回实时消息

附近消息

全部