为什么选ComfyUI不用WebUI

Stable Diffusion有多个客户端。WebUI(A1111)适合新手和单图生成,但工作流固定。ComfyUI是节点式工作流,每个步骤可视化连接,适合搭建复杂流水线(批量出图、多模型协作、视频生成)。对于设计师批量产出统一风格素材,ComfyUI工作流可保存复用,效率是WebUI的5-10倍。

第一步:硬件准备

SDXL模型对显卡要求:

  • 最低——6GB显存(如RTX 3060),可生成1024×1024慢速
  • 推荐——12GB显存(如RTX 4070),可批量512×512
  • 理想——24GB显存(如RTX 4090),可批量1024×1024视频
  • 无独显——用云端(Google Colab免费版、AutoDL按小时租)

第二步:安装ComfyUI

Windows安装(推荐官方便携版):

  1. 下载NVIDIA驱动和CUDA
  2. 下载ComfyUI_windows_portable压缩包
  3. 解压到非中文路径(如D:/ComfyUI)
  4. 双击run_nvidia_gpu.bat启动
  5. 浏览器访问 http://127.0.0.1:8188

启动后看到空白画布即成功。

第三步:下载SDXL模型

两个核心模型:

  • SDXL Base——主模型,huggingface.co/stabilityai/stable-diffusion-xl-base-1.0
  • SDXL Refiner——精修模型,huggingface.co/stabilityai/stable-diffusion-xl-refiner-1.0

放入ComfyUI/models/checkpoints/目录。

第四步:基础工作流——文生图

在ComfyUI画布搭建:

  1. CheckpointLoaderSimple节点——加载SDXL Base
  2. CLIPTextEncode节点×2——正向prompt和负向prompt
  3. EmptyLatentImage节点——设置尺寸和批次
  4. KSampler节点——采样器,配置steps和cfg
  5. VAEDecode节点——把潜在空间解码为图像
  6. SaveImage节点——保存图片

连接方式:CheckpointLoaderSimple.Model → KSampler.Model;CLIPTextEncode → KSampler.Positive/negative;EmptyLatentImage → KSampler.latent_image;KSampler → VAEDecode;VAEDecode → SaveImage。

第五步:批量出图设置

关键节点参数:

  • EmptyLatentImage的batch_size——设为4/8/16表示每批出几张图
  • KSampler的seed——固定种子可复现,-1随机
  • SaveImage的filename_prefix——加日期和主题方便归档

一次设置工作流,批量跑20张图选最优1张。比单张迭代快10倍。

第六步:加入Refiner精修

提升图像细节:

  1. KSampler1(Base模型跑前80%步数)→ 加KSampler2(Refiner模型跑后20%步数)
  2. 用VaeDecode解码为图像

Base负责构图,Refiner负责细节。组合后图像细节比单用Base高30%。

第七步:图生图精修

有粗稿想精修时用图生图:

  1. 加载LoadImage节点导入图片
  2. 用VAE Encode转latent
  3. KSampler的denoise值降到0.3-0.5(保留原图细节只加细节)
  4. 其他同文生图流程

第八步:ControlNet控制姿态/构图

需要精确控制人物姿态或构图:

  1. 下载ControlNet模型(openpose、canny、depth等)放入ComfyUI/models/controlnet/
  2. 加载LoadControlNetModel节点
  3. 用ApplyControlNet节点挂到KSampler
  4. 上传参考图或骨架图

ControlNet配合SDXL可以做精确的姿势控制、商业级构图复刻。

第九步:保存为模板

满意的工作流导出为PNG或JSON,下次直接拖入复用。命名规范:[类别]_[用途]_[参数]。例如commercial_product_v3.json、illustration_book_v2.json。

常见错误

  • 显存OOM——降低批次大小或出图分辨率
  • 黑图——检查VAE是否正确加载
  • 出图与prompt不符——CFG值提高(7-9),steps增加(30-50)
  • 手/脸崩坏——加adetailer插件或局部重绘

效率提升

ComfyUI工作流搭好后,批量出100张候选图选最佳——比一张张调到满意快10倍。对于电商详情页、品牌视觉系统、漫画分镜等需要统一风格的批量生产场景是必备工具。本地部署零边际成本(除电费),无云服务依赖。