过去 12 小时的精选 AI 资讯聚焦 Qwen-Image-2.1:这款 7B 视觉模型统一了图像生成与编辑能力,支持原生 2K、透明图像和多参考图编辑,并已接入 ComfyUI。开源模型正在从“能生成”进一步走向更灵活、更适合实际创作工作流的生产工具。

模型发布/更新

Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
来源:Qwen:Blog Retrieval(API) · 今天晚上 20:00 · 阅读原文

Qwen 团队开源了 Qwen-Image-2.1,将文生图与图像编辑统一到一个 7B 模型中,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图,也可以使用圆形、涂鸦或独立蒙版指定局部编辑区域;同时通过混合粒度注意力架构和 KV cache 复用提升推理效率,并改进文字渲染、人像光照、人物与产品保真度,覆盖全景图、信息图和分镜等任务。

产品发布/更新

Qwen-Image-2.1 已支持 ComfyUI,开源权重开放下载
来源:X:通义千问 / Qwen (@Alibaba_Qwen) · 今天晚上 21:52 · 阅读原文

Qwen 宣布 Qwen-Image-2.1 现已支持 ComfyUI,权重开放下载。单个 7B checkpoint 同时支持图像生成与编辑,可原生生成 2K 图像,单次最多基于 10 张参考图进行指令编辑,并支持带 alpha 通道的 RGBA 输出。对 ComfyUI 用户来说,这意味着模型能力可以更直接地接入现有节点式创作流程。


今日关键词: Qwen-Image-2.1、ComfyUI、开源模型、图像生成、图像编辑、透明图像