【免费下载链接】Qwen-Image-2.1Qwens most powerful open-source image generation model项目地址https://gitcode.com/gh_mirrors/qw/Qwen-Image-2.1点击查看免费下载Qwen-Image-2.1 是 Qwen 家族最强大的开源图像生成与图像编辑模型视觉生成组件仅 7B 参数却用一个模型统一了**文生图T2I与图像编辑I2I**两大能力。本教程用 5 个代码示例带你从单图换背景一步步走到 10 张参考图的多主体合成最后再附上官方提示词改写的接入方法。✨ 为什么值得部署 Qwen-Image-2.1 做图像编辑相比文生图 后期抠图的多步流程Qwen-Image-2.1 的图像编辑能力直接一步到位多参考图编辑最多支持10 张参考图一次合成多主体并保持人物/商品身份一致️局部精准编辑用圈选、手绘标注或独立 mask 指定要改的区域其余部分保持原样原生透明背景一个模型同时生成普通图片和 RGBA 透明图还能做抠图原生 2K 分辨率支持 1:1、16:9、9:16 等 7 种推荐比例⚡低算力成本混合粒度注意力 前缀 KV 缓存复用多条件图编辑时上下文只编码一次下面这张全景图就是模型从一张普通自拍照扩展出的 2K 全景作品感受一下它的编辑上限 一键安装步骤环境与依赖准备图像编辑基于 Diffusers 的QwenImage21Pipeline一条命令装好依赖pip install torch2.4.0 pip install transformers5.17 pip install githttps://github.com/huggingface/diffusers pip install accelerate pillow 显存有限加载后调用pipe.enable_model_cpu_offload()即可把模型权重自动搬到 CPU24GB 显卡也能跑 2K 出图。模型加载统一使用模型 IDQwen/Qwen-Image-2.1默认参数为40 步去噪、2048×2048 分辨率。✏️ 示例1AI换背景——单图编辑最常用姿势拿到管线后换背景只需要传入输入图片 一句编辑指令import torch from PIL import Image from diffusers import QwenImage21Pipeline pipe QwenImage21Pipeline.from_pretrained( Qwen/Qwen-Image-2.1, torch_dtypetorch.bfloat16 ).to(cuda) image pipe( promptChange the background to a sunset beach, imageImage.open(input.png), num_inference_steps40, generatortorch.Generator(cuda).manual_seed(42), ).images[0] image.save(edit_result.png)三个小技巧指令写改什么不写不要动什么——模型会默认保持未提及的内容不变固定seed方便对比不同指令的效果差异指令支持中文、英文、日文等任意语言都能下达编辑指令 示例2局部编辑——圈选区域只改你想改的局部编辑是 Qwen-Image-2.1 图像编辑的杀手级能力在原图上画一个圈或手绘标注、独立 mask指令里指明圈选区域即可。以官方示例数据里的一个真实案例为例——让角色头部向左转、身体保持不动image pipe( promptLet the head twist to the left, while the body and arms stay exactly as they are, imageImage.open(marked.png), # 已圈选头部的图片 num_inference_steps40, ).images[0]真实输入可以查看 prompt_rewrite/data/edit_example.jsonl同一张图还支持换发色、换服装等多区域圈选编辑。 示例3多主体合成——最多10张参考图一次出图这是传统单图编辑模型做不到的把多张参考图里的主体同时放进同一个新场景且身份特征人脸、服饰、商品外观保持一致。官方示例数据里就有一个中文多主体案例将两张人物照片置入现代直播间场景保持两位人物的面部特征、发型和服装外观完全不变。代码只需把image从单张图换成列表images [Image.open(fref_{i}.png) for i in range(3)] # 最多10张 result pipe( promptThese three characters are sitting around a campfire in a forest, imageimages, num_inference_steps40, ).images[0] result.save(multi_ref_result.png) 多参考图编辑会自动启用前缀 KV 缓存所有条件图与文本只编码一次后续去噪步骤全部复用多图合成速度远快于朴素实现。 顺手一提图像文字编辑与多语言渲染Qwen-Image-2.1 对图内文字的渲染与改写也很强——示例数据中有一张带日文标题的角色海报指令只有一句话 Translate into Hindi.模型就能把画面里的日文标题翻译成印地语并保持排版风格 示例4透明背景生成——RGBA贴纸一步到位不需要抠图工具用官方推荐的 RGBA 提示词格式直接生成带 alpha 通道的透明图image pipe( promptThis is an RGBA image with transparency. A cute cartoon dragon sticker. The image has alpha channel and the background is transparent., num_inference_steps40, ).images[0] image.save(transparent_example.png) # 自动保存为RGBA电商素材、表情包、贴纸生产场景可以直接省掉一整条抠图管线。✨ 示例5提示词改写——让编辑指令更专业一句简短指令往往不如一段看图说话式的长描述出图好。官方提供了两个基于 Qwen3.5-VL 9B 微调的改写模型文生图一个、图像编辑一个统一代码库位于 prompt_rewrite/细节见 prompt_rewrite/README.mdgit clone https://gitcode.com/gh_mirrors/qw/Qwen-Image-2.1 cd Qwen-Image-2.1/prompt_rewrite pip install -r requirements.txt # 图像编辑任务改写批量推荐走 vLLM python run_vllm.py --task edit \ --ckpt Qwen/Qwen-Image-2.1-PE-I2I \ --input data/edit_example.jsonl --output out.jsonl输出会给出rewritten_prompt改写后的长指令和画布比例建议wh_ratio或ratio_follow把长指令喂回管线即可import json rewrite json.loads(open(out.jsonl).readline()) image pipe( promptrewrite[rewritten_prompt], imageImage.open(input.png), num_inference_steps40, ).images[0]改写模块的核心逻辑任务配置、指令解析、输出格式都收敛在 prompt_rewrite/pe_core.py想在线服务可以用 prompt_rewrite/serve.sh 起一个 vLLM 服务再用 prompt_rewrite/client.py 发请求。 进阶技巧推荐参数与常见配置参数推荐值说明num_inference_steps40去噪步数质量与速度的平衡点width × height2048 × 2048原生 2K可按比例调整显存不足enable_model_cpu_offload()权重自动卸载到 CPU常用推荐比例源自 README.md比例分辨率典型用途1:12048×2048头像、商品图16:92752×1536海报、横幅、全景9:161536×2752短视频封面、手机壁纸 总结5个示例能力速查示例能力关键 API 写法示例1AI换背景image单图 编辑指令示例2圈选局部编辑圈选图 区域指令示例3多主体合成image[多张图]≤10张示例4透明背景RGBA 提示词格式示例5提示词改写prompt_rewrite/ 改写后回填从换背景到多主体合成Qwen-Image-2.1 用一套代码覆盖了主流图像编辑场景。项目许可证见 LICENSE权重可从 ModelScope 与 Hugging Face 的 Qwen 官方组织页下载。跑通第一个示例后建议直接打开 prompt_rewrite/data/edit_example.jsonl 里的真实案例继续练手赞分享【免费下载链接】Qwen-Image-2.1Qwens most powerful open-source image generation model项目地址https://gitcode.com/gh_mirrors/qw/Qwen-Image-2.1点击查看免费下载相关推荐5分钟升级游戏DLSS版本DLSS Swapper免费游戏帧率优化实测记5分钟升级游戏DLSS版本DLSS Swapper免费游戏帧率优化实测记 昨晚打《赛博朋克 2077》开光追后帧数直接掉到 40 以下而游戏里的 DLSS桌面应用Qwen-Image 2.1图像编辑能力上手官方image_edit工作流从导入到出图全图解Qwen Image 2.1图像编辑能力上手官方image_edit工作流从导入到出图全图解 Qwen Image 2.1 图像编辑是当下 ComfyUI 生人工智能大模型媒体生成多模态Qwen Image Edit 2509完全指南5步掌握多图像AI编辑技巧Qwen Image Edit 2509完全指南5步掌握多图像AI编辑技巧 想要将多张照片完美融合创造出令人惊艳的视觉效果吗Qwen Image Edit计算机视觉Qwen创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考