实时 AI 消息
通义千问上线 Qwen-Image-2.1-PE:同时放出文生图与图像编辑两个版本
9月20日,通义千问在 Hugging Face 官方组织下上线 Qwen-Image-2.1-PE 系列的两个模型条目,分别对应文生图(T2I)与图像编辑(I2I)。两个仓库都带有 prompt-rewriting 与 qwen3_5 标签,授权标注为 license:other,截取时下载量仍为 0,属于刚刚发布的早期状态。

9月20日,通义千问团队在其 Hugging Face 官方组织下上线了 Qwen-Image-2.1-PE 系列的两个模型条目:Qwen/Qwen-Image-2.1-PE-T2I 与 Qwen/Qwen-Image-2.1-PE-I2I。两个条目均标记为官方模型仓库更新,而不是第三方转存。
从命名看,两个版本的定位被明确区分:T2I 对应文本生成图像(text-to-image)流程,I2I 对应图像编辑(image-editing)。也就是说,同一代号的模型同时覆盖“用提示词造图”和“在已有图像上改图”两条主要使用路径。
仓库标签给出了更多线索。两者都带有 safetensors、qwen3_5、qwen 等标签,并共同标注了 prompt-rewriting,说明使用流程中很可能引入了提示词改写环节,把用户的自然语言描述先整理成更适合生成模型的指令。

授权方面,两条条目都标注 license:other 与 region:us。这意味着授权条款并非 Apache 2.0 或 MIT 这类标准开放许可,开发者在商用前需要先读模型卡中的具体约定。
截取时的数据同样值得注意:两个仓库的下载量都是 0,点赞数分别为 1 与 0。这说明条目刚刚建立,社区尚未开始试用,模型的真实能力还没有公开的第三方验证。
文生图与图像编辑同代发布,也便于在同一套提示词改写逻辑下做一致性工作流,例如先改提示、再生成、再局部编辑。对于需要批量出图并反复微调的产品团队,这种“一个系列覆盖两个环节”的发布节奏比单个 SOTA 模型更有落地价值。
目前公开信息仍然有限:参数量、训练数据、评测结果,以及是否同步上线云服务或国内模型平台,都没有出现在候选信息中。代号里的 PE 具体指什么,也需要等官方模型卡或技术报告确认。
接下来的观察点有三个:模型卡是否补齐参数与评测信息;授权条款是否允许商用;以及这两个版本会不会在 Qwen 的在线服务与国内平台上同步开放。
来源
为什么重要
同一代号同时覆盖生成与编辑,说明图像模型的竞争点正在从“能不能画”转向“能不能按指令改”。授权标注为 license:other,也意味着企业采用前需要先确认商用边界。
附近消息
全部09/20 19:48
阿里Qwen3.8-Omni-Flash被描述为“能听、能看、能行动”的统一模型
据The Eastern Herald报道,阿里巴巴的Qwen3.8-Omni-Flash被描述为一个同时具备听觉、视觉与行动能力的模型。报道以“一个模型,能听、能看、能行动”概括其定位,指向多模态感知与智能体行动能力的融合。
09/20 21:02
Tempus 获 ARPA-H 最高 950 万美元资助,开发心力衰竭护理自主 AI 智能体
据 Pulse 2.0 报道,Tempus 获得美国卫生高级研究计划局(ARPA-H)最高 950 万美元的资金支持,用于开发面向心力衰竭护理的自主 AI 智能体。这笔资助把 Agent 形态的软件推进到长期慢病护理这一高风险场景。
09/20 18:50
又一国产MoE旗舰模型登场:跻身全球开源第三,价格对标DeepSeek-V4-Pro
9月20日,智东西报道称又一款国产MoE旗舰模型登场,在开源阵营中跻身全球第三,定价则直接对标DeepSeek-V4-Pro。名次与价格两条线同时抬升,让国产开源模型的竞争再度升温。
09/20 18:39
智谱披露GLM-5.3:模型开始优化承载自己的推理系统,RSI迹象初现
开源中国发布的报道显示,智谱披露了GLM-5.3的相关情况,其初步显现的RSI(递归自我改进)迹象受到关注:模型开始优化承载自身运行的推理系统。这一表述把“模型改进自己的执行环境”从概念讨论推进到了具体产品层面。