郭震 AI公众号:郭震AI

实时 AI 消息

Qwen开源Qwen-Image-2.1:7B视觉生成模块统一文生图与图像编辑

9月21日,Qwen团队在Hugging Face上开源了Qwen-Image-2.1,这是一个把文生图与图像编辑合并在同一套流程里的统一模型,负责视觉生成的部分只有7B参数、由32层单流DiT构成。新版本主打原生透明通道,支持最多10张参考图与掩码指定的局部修改,并已在diffusers中以QwenImage21Pipeline的形式提供支持。

发布时间
Qwen开源Qwen-Image-2.1:7B视觉生成模块统一文生图与图像编辑
图源: huggingface.co

9月21日,Qwen团队在Hugging Face上更新并开源了Qwen-Image-2.1,这是一个把文生图与图像编辑合并在同一套流程里的统一模型。仓库信息显示其流水线为text-to-image、使用diffusers库,标签覆盖图像生成、图像编辑、RGBA与文生图,许可证为qwen-research。

这次发布最直观的数字是体量:负责视觉生成的部分只有7B参数,由32层单流DiT(Single-Stream DiT)构成。官方把架构概括为“紧凑高效”,通过混合粒度注意力与prefix KV cache复用,在较低算力开销下维持画质。

最具辨识度的能力是原生透明通道。模型可以直接从文本生成普通图像或带真实alpha通道的RGBA图像,也能编辑透明图层,并从已有照片中把主体抠出来——这些都在同一个权重里完成,而不是靠串接多个工具。

编辑能力也不是点缀。Qwen-Image-2.1最多支持10张参考图,可用圆圈、手绘标注或单独掩码指定局部修改,并针对人物与商品的身份一致性做了保留;官方还强调字体排版、人像布光和细节质感都有改善。

配套资源同步到位:ModelScope镜像、qwen.ai博客、Hugging Face Space演示、Discord频道,仓库里甚至放了微信二维码。diffusers侧以QwenImage21Pipeline的形式集成,几行Python即可加载。

社区反应已经出现,但仍处于早期。截至这次仓库更新,模型卡记录了183次下载与913个likes,围绕它已经出现了十多个社区Space,涵盖demo、studio和图像生成应用。

值得关注的地方在于,RGBA输出和10张参考图的编辑能力,把开源图像模型往设计与生产工作流里又推了一步——透明素材和对象一致性,通常正是团队为闭源工具付费的理由。7B的生成模块也让单卡自部署继续保持在可行区间。

后续看点有三个:ComfyUI等生态工具与量化运行时的接入速度、qwen-research许可证是否足以支撑商业落地,以及社区微调能否在编辑路径上做出基础权重之外的效果。

为什么重要

对开源图像生成生态来说,Qwen-Image-2.1把透明通道与多参考图编辑塞进了单一权重,压缩了闭源工具在设计与电商素材场景中的差异化空间。

微博邮件

QwenOpen SourceImage Generation
返回AI日报

附近消息

全部

09/21 13:53

MiniMax 开源 MiniMax Code:把终端编程智能体交给开发者

据 TechNode 报道,MiniMax 开源了名为 MiniMax Code 的终端编程智能体,开发者可以直接获取并使用这套运行在命令行里的编码工具。把自家编程智能体开放出来,意味着 MiniMax 希望在由头部厂商主导的编程工具竞争中靠开源争取开发者,但仓库地址、许可证与支持范围仍待官方细节确认。

09/21 14:06

亚马逊阻止Meta的Muse智能体在其网站购物,代理式电商之争升级

据GeekWire报道,亚马逊以安全、隐私和透明度为由,阻止Meta新推出的个人AI智能体Muse在Amazon.com上购物,此前还曾试图让Meta把该网站排除在这项体验之外。使用Muse在亚马逊购物的用户现在会看到弹窗,提示未经授权的AI智能体继续访问违反亚马逊使用条款;亚马逊称事先并不知情也未授权,Meta当晚未回应置评请求。

09/21 14:22

GPT-6 Astra开进机器人身体!清华联手无问芯穹等开源RPent

清华大学、无问芯穹、正行创新联合发起的具身智能体基础设施RPent正式开源,把通用大模型的任务理解与规划能力、VLA等专家模型的精细操作能力,与记忆、工具和机器人接口连成从感知到反馈纠错的完整闭环。该系统在LIBERO-PRO基准测试中达到92.6%的任务成功率,并将端到端任务完成速度优化7倍以上,真机可完成倒钢珠、双臂擦盘、移开遮挡物找勺子等开放式任务。

09/21 11:02

中国 AI 大模型周调用量连续二十一周领跑,DeepSeek V4.1-Flash 登顶并环比增长 219%

最新一周的统计显示,中国 AI 大模型调用量连续第二十一周领跑,DeepSeek V4.1-Flash 位居榜首,环比增长 219%。这组数据由富途牛牛整理发布,反映国内大模型 API 调用规模仍在快速扩张。