1. ComfyUI安装与环境准备
ComfyUI作为Stable Diffusion的可视化编程工具,其安装方式主要分为线上平台和本地部署两种方案。对于刚接触AI绘画的开发者,我强烈建议从线上平台开始体验,这能避免复杂的本地环境配置问题。
1.1 线上平台快速体验
目前国内最稳定的ComfyUI托管平台是LibLibAI,其优势在于:
- 预装最新版ComfyUI及常用插件
- 内置数十个主流Checkpoint模型
- 无需担心显卡驱动、CUDA版本等兼容性问题
- 支持工作流一键导入/导出
访问LibLibAI后,在创作页面选择"ComfyUI"模式即可开始使用。平台已预置基础文生图工作流,适合快速上手体验。
1.2 本地安装详细指南
对于需要长期使用或开发自定义节点的用户,本地安装能提供更灵活的定制空间。以下是Windows系统的标准安装流程:
-
基础环境准备:
- 显卡要求:NVIDIA显卡(建议RTX 3060以上)
- 显存容量:最低8GB(生成512x512图像)
- 安装Python 3.10.6(必须此特定版本)
- 配置Git环境
-
核心依赖安装:
bash复制git clone https://github.com/comfyanonymous/ComfyUI
cd ComfyUI
python -m pip install -r requirements.txt
-
模型文件配置:
- 将Stable Diffusion模型(.ckpt或.safetensors)放入
models/checkpoints - VAE模型放入
models/vae - LoRA模型放入
models/loras
- 将Stable Diffusion模型(.ckpt或.safetensors)放入
-
启动运行:
bash复制python main.py --listen
访问http://localhost:8188即可进入Web界面
注意:首次启动时会自动下载CLIP等必要模型,请确保网络通畅。若遇到库版本冲突,建议使用虚拟环境隔离。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 界面操作与核心概念解析
2.1 工作台基础操作
ComfyUI采用节点式工作流设计,掌握以下两个基础操作是构建复杂流程的前提:
-
视图缩放:
- 快捷键:
Ctrl + 鼠标滚轮 - 应用场景:当节点过多导致界面拥挤时,缩小视图可纵览全局;放大则便于精细调整连接关系
- 快捷键:
-
画布平移:
- 操作:按住鼠标中键拖动
- 技巧:长按空格键可临时切换为抓手工具,实现快速导航
2.2 核心组件深度解析
2.2.1 节点(Node)系统
每个功能模块都以节点形式存在,主要分为三类:
- 输入类节点:如CLIP文本编码器、Latent生成器
- 处理类节点:K采样器、VAE解码器
- 输出类节点:图像预览、模型保存
节点间的数据流动形成完整工作流。右键空白处可调出节点创建菜单,按类别查找所需功能。
2.2.2 连接(Connection)规则
连接线遵循严格的类型匹配原则:
- 相同颜色的插槽才能建立连接
- 实线表示必须连接,虚线表示可选连接
- 鼠标悬停在插槽上会显示数据类型提示
常见错误:尝试连接不兼容的端口会导致红色错误提示,此时需要检查上游节点的输出类型。
2.2.3 正负面提示词系统
-
正面条件(Prompt):
- 通过CLIP文本编码器节点输入英文描述
- 语法建议:使用逗号分隔不同要素,如
masterpiece, best quality, 1girl, cherry blossoms - 权重控制:
(word:1.3)表示增强权重,[word:0.7]表示减弱权重
-
负面条件(Negative Prompt):
- 用于排除不希望出现的元素
- 典型用法:
lowres, bad anatomy, extra digits - 高级技巧:添加
blurry可减少画面模糊,text可避免生成文字
2.2.4 K采样器核心参数
作为工作流的中枢,K采样器包含以下关键参数:
steps:迭代次数(20-30为常用范围)cfg:提示词遵循度(7-9效果较平衡)sampler:采样算法(推荐DPM++ 2M Karras)seed:随机种子(-1表示随机)
2.2.5 Latent空间控制
Latent节点决定生成图像的元信息:
width/height:建议设为64的倍数(如512,768)batch_size:同时生成的图片数量(受显存限制)- 进阶用法:可连接Empty Latent Image节点实现动态尺寸
2.2.6 Checkpoint模型加载
Checkpoint加载器的重要属性:
ckpt_name:选择基础模型(如realisticVision, anything-v5)vae:可选配专用VAE改善色彩表现- 模型管理:大模型文件通常需手动下载放入指定目录
3. 基础文生图全流程实操
3.1 标准工作流搭建
按照以下步骤构建完整的文生图流程:
- 创建Checkpoint加载器节点,选择目标模型
- 添加CLIP文本编码器节点,分别连接正面和负面提示词
- 插入Empty Latent Image节点设置输出尺寸
- 配置K采样器节点,连接上述所有输入
- 最后添加VAE解码器将Latent转为图像
3.2 参数优化技巧
-
分辨率设置:
- 显存8G:建议不超过512x768
- 显存12G:可尝试768x1024
- 需要更高分辨率时,应使用高清修复(Hi-Res Fix)
-
提示词工程:
- 结构化写作:
[主体], [细节], [环境], [风格], [画质] - 风格控制:添加
by 艺术家名可模仿特定画风 - 负面词库:建议保存常用模板避免重复输入
- 结构化写作:
-
采样器选择:
- 快速出图:Euler a
- 高质量输出:DPM++ 2M Karras
- 创意探索:DDIM(适合艺术化效果)
3.3 典型问题排查
-
显存不足(OOM):
- 降低batch_size或分辨率
- 启用--medvram启动参数
- 使用Tiled Diffusion插件分段渲染
-
中文乱码问题:
- 必须使用英文输入
- 需要中文可先用翻译工具转换
- 高级方案:安装双语CLIP扩展
-
图像质量缺陷:
- 出现畸形:加强负面词如
deformed, bad anatomy - 色彩异常:更换VAE模型
- 细节不足:增加steps或启用Hi-Res Fix
- 出现畸形:加强负面词如
4. 效率提升与进阶技巧
4.1 工作流管理
-
模板保存:
- 点击Save按钮保存为.json文件
- 推荐按用途分类存储(如人像、场景设计等)
- 可分享给团队其他成员复用
-
节点分组:
- 选中多个节点后按Ctrl+G创建组
- 双击组可添加注释说明
- 适合封装复杂子流程
4.2 扩展安装方法
通过Manager安装常用插件:
- 访问ComfyUI Manager界面
- 搜索目标插件(如Impact Pack, WAS Node Suite)
- 点击Install自动下载依赖
- 重启后即可使用新节点
4.3 性能优化方案
-
显存控制:
- 使用--lowvram模式运行
- 启用CPU卸载选项
- 合并K采样器减少中间变量
-
渲染加速:
- 选用xformers优化
- 开启TensorRT加速
- 对静态元素使用缓存节点
在实际项目中,我习惯将常用工作流拆分为多个子流程,通过API调用实现批量化生产。例如先运行基础文生图,再接入ControlNet进行精确控制,最后用Ultimate Upscale提升分辨率,这种模块化设计能显著提升复杂项目的开发效率。
