news 2026/9/18 11:17:58

【ComfyUI】QwenImageEdit 基础图生图

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
【ComfyUI】QwenImageEdit 基础图生图

今天展示的案例是一个基于Qwen-Image 编辑功能的 ComfyUI 工作流。该工作流围绕图像编辑展开,通过加载扩散模型、文本编码器、VAE 模块以及 LoRA 适配器,结合输入图像与文本提示,实现对图像中元素的精准移除与增强效果。

整体设计不仅保证了画面质量,也通过采样器与归一化组件提升了生成的稳定性,最终输出高质量的编辑结果。

文章目录

  • 工作流介绍
    • 核心模型
    • Node节点
  • 工作流程
  • 大模型应用
    • TextEncodeQwenImageEdit 双语文本与语义外观控制
    • TextEncodeQwenImageEdit (Negative Prompt) 负向语义控制
  • 使用方法
  • 应用场景
  • 开发与应用

工作流介绍

这个工作流主要面向图像的定向修改与修复场景。通过引入 Qwen-Image 的专用扩散模型与配套 VAE 编码器,结合 Qwen 2.5 版本的多模态文本编码器,可以让输入提示词直接指导图像的修改区域。LoRA 模型作为轻量级适配器,大幅缩短了推理所需步骤,同时保持风格一致性。整体流程中,KSampler 与 CFGNorm 节点确保了采样结果的质量与一致性,而图像缩放与保存节点则保证了最终输出适应不同分辨率的需求。

核心模型

在该工作流中,核心模型由四部分组成。扩散模型负责图像生成的基础逻辑,VAE 模块完成潜在空间与像素空间的互转,CLIP 文本编码器使提示词具备指导性,而 LoRA 则提升了生成效率并适配不同编辑需求。这些模型通过互相协作,使得图像编辑能够在较低的推理步数中完成,同时确保生成效果的清晰度和语义一致性。

模型名称说明
qwen_image_edit_fp8_e4m3fn.safetensors主要扩散模型,负责图像编辑的核心生成逻辑
qwen_image_vae.safetensorsVAE 模型,
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/18 11:17:26

【ComfyUI】OmniGen2 基础图生图

今天展示的案例是一个基于 ComfyUI 的 Omnigen2 图生图工作流,通过输入原始图像与文本提示词,结合噪声生成、潜空间参考以及双重条件引导的机制,实现了透明晶体质感的人物再创作效果。 整个流程以清晰的阶段设计串联,从模型加载、图像输入、文本编码到采样生成与解码输出,…

作者头像 李华
网站建设 2026/9/18 11:17:21

Electron跨平台语音工作室架构实战

1. 项目概述:一个跨平台语音工作室的诞生逻辑VoiceStudio 这个名字一出来,我就知道它不是个简单的录音小工具——它瞄准的是专业创作者、播客制作人、配音演员、语言教师,甚至远程会议频繁的职场人的真实工作流痛点。我做过三年播客后期&…

作者头像 李华
网站建设 2026/9/18 11:16:12

30个免费CSS加载动画:从原理到实战的完整指南

1. 为什么需要CSS加载动画1.1 加载动画不只是“转圈圈”做前端的这些年,我越来越觉得加载动画是页面体验里最容易被低估的一环。用户打开一个网站,最怕的不是内容多,而是“不知道要等多久”。一个转圈圈、一条流动的进度条、一片渐变的骨架屏…

作者头像 李华
网站建设 2026/9/18 11:15:38

UE Windows 交叉编译 Linux 项目打包实战指南

做UE项目这些年,真正让人半夜爬起来改配置的,往往不是渲染管线调参,也不是网络同步那套东西,而是"我这台Windows开发机,怎么才能一键出一个能在Linux上跑起来的包"。UE、Windows、Linux、交叉编译、项目打包…

作者头像 李华
网站建设 2026/9/18 11:10:28

【ComfyUI】Z-Image 基础文生图 + 单LoRA

今天给大家演示一个 Z-Image Turbo 基础文生图 ComfyUI 工作流。 该工作流以轻量化 UNet 为核心,配合 Qwen Image 文本理解模型与基础 LoRA 风格注入,实现从文本描述到图像生成的完整闭环。整体结构清晰、节点数量精简,既适合作为 Z-Image 系列模型的入门示例,也方便用户在…

作者头像 李华