做AI绘画做得越久,越容易产生一种错觉:只要模型够好,图就能直接卖钱。真把图放到商业项目里才发现,出图只是第一步,后面还跟着改图、控图、批量交付、跨软件协作这一长串事。今天想完整拆解的这套实战工作流,核心就两样东西:ComfyUI负责把AI绘画过程做成可复用的节点管线,PS负责把生成结果精修成能见客户的成品。这套组合是我在接了电商、自媒体、插画定制三类项目后逐步打磨出来的,尤其适合那些已经会用AI绘图,但还不知道怎么把它变成稳定生产力的朋友。
1. 为什么是ComfyUI+PS:这套工作流解决了什么问题
1.1 出图容易,控图难
刚接触AI绘画时,大家最先体验到的往往是"提示词改动一个字,结果就完全不一样"的惊喜。可到了实际项目里,这种不确定性就是灾难:客户说"整体构图不变,把模特衣服从红色改成蓝色",你在WebUI里改了提示词重跑,出来的可能是完全不同的构图;你在PS里硬改颜色,衣服质感、光影又会变得不协调。ComfyUI解决的核心问题就是"控图"——把生成管线拆成节点,让每一步都可观察、可保留、可复现。控图能力越强,越接近商业项目需要的稳定性。
1.2 两个软件的分工逻辑
ComfyUI和PS在一条工作流里的分工,可以类比成"拍摄现场"和"后期工作室"。ComfyUI负责的是拍摄现场的部分:选演员(底模)、定造型(LoRA)、摆构图(ControlNet)、连续拍一堆候选画面(批量生成)。PS负责的是后期工作室的部分:选片、修瑕、调色、排版、输出。这种分工之所以高效,是因为它把"创意探索"和"精细加工"两个环节彻底分离。创意探索阶段需要大量快速试错,交给ComfyUI的节点批处理再合适不过;精细加工阶段需要人眼判断和像素级操作,交给PS的成熟工具链。
1.3 不是在"二选一",而是"一加一大于二"
有些朋友会问:只学ComfyUI不就行了?或者只在PS里用AI插件不行吗?我的看法是,单用ComfyUI生成的图,距离商用始终差"精修打磨"这一道工序;只用PS的AI功能,生成本身又受限于一个个弹窗和固定面板,缺少批量、缺少参数化的管线控制。把两者合并成一条完整工作流后,最直观的变化是:同一批图的质量一致性显著提升。你可以在ComfyUI里锁定种子、模型、参数,让所有候选图拥有同一套色彩倾向和风格基调,再进PS做统一处理,交付物看起来就是"一组有体系的图",而不是"散装出图"。
1.4 这套工作流适合谁
如果你属于以下任一类人群,这套方案值得认真研究:电商设计或美工,产品图、模特图、场景图的需求量大,且要求风格统一、修改频繁;自媒体创作者,每天需要大量配图,质量和出图速度同样重要;独立设计师或插画师,想用AI做前期概念探索,同时保留精细的人工把控;工作室或小团队负责人,希望沉淀一套可复用的出图流程,而不是每次项目从零开始。反之,如果只是偶尔玩图、每月出三五张社交头像,那直接用网页版或简单工具就够,不需要搭这么完整的一套管线。
2. ComfyUI的节点逻辑:把"绘画过程"拆成零件
2.1 节点是什么?一个流水线类比
ComfyUI的核心是"节点式工作流"。每个节点负责一个明确的任务,节点和节点之间用连线传递数据。这套思路非常适合AI绘画,因为一次生成不是单一动作,而是一条数据流:模型加载、条件编码、采样循环、图像解码、结果保存,每一步都是独立的环节。它的逻辑很像工厂流水线:模型加载器是原料库,提示词编码是下单员,采样器是核心加工车间,VAE解码是质检包装。看懂了每个环节的职责,就能理解为什么ComfyUI可以只替换某一个节点,而不影响其他部分。
2.2 一套基础文生图工作流的关键节点
刚上手ComfyUI时,不需要把每个节点都弄懂,先认识五个核心节点就够了。CheckpointLoaderSimple负责加载底模,从模型文件中读取主模型,相当于选择"哪位画家"来作画。CLIPTextEncode负责提示词编码,把文字提示转换成模型能理解的语义向量,正向提示词告诉模型要画什么,负向提示词告诉模型不要出现什么。EmptyLatentImage用来定义一个空白的画布,包括宽度、高度和批次数量。KSampler是真正的核心引擎,负责执行多步扩散采样,它决定了出图的质感、风格和稳定性。VAEDecode把潜空间数据还原成肉眼能看到的像素图像,之后就可以保存和展示了。这样一套流程串下来,一次文生图就完成了。
2.3 连线就是数据流,理解它你就理解了一切
很多新手在ComfyUI里迷路,不是因为节点功能复杂,而是没把连线看懂。一条连线代表一个数据对象:可能是模型文件、条件向量、潜空间图像、普通图像,也可能是掩码。ComfyUI会根据数据类型自动选择端口,并拒绝连接类型不匹配的组合。连线的方向一定是"从输出到输入",顺着数据流读下去,整张工作流图就是一个可视化的推理管线。我建议新手拿到任何陌生工作流时,别急着看每个节点细节,先跟着连线走一遍:数据从哪个文件加载?中间经过哪些模型?最后输出到哪里?用这套"读图"方法,再复杂的模板也能快速梳理清楚。
2.4 模板与复用的工程价值
工作流之所以叫"工作流",因为它不只为了单次出图,更是为了沉淀成可复用的模板。ComfyUI官方和社区提供了大量现成模板:文生图、图生图、局部重绘、LoRA角色一致性、ControlNet条件控制、视频转绘等。我的习惯是下载模板后不直接使用,先做一次"逻辑拆解":把每个节点按功能重新分组、加上备注、调整自己常用的参数默认值,最后另存为个人模板。这样做的工程价值在于:当你面对一个新项目时,能从模板库里快速找到一个最接近的管线,改改模型和提示词就能应对,不用每次从空画布开始。
3. 实战搭建:从零到能出图的完整工作流
3.1 环境准备:整合包与原生安装怎么选
ComfyUI是开源项目,核心依赖是Python和PyTorch。最直接的安装方式是克隆官方仓库后运行启动脚本,但这需要手动配置Python环境、CUDA版本、依赖包,对非技术背景的设计师不太友好。所以现在国内大多数用户会选择社区维护的整合包(比如秋叶整合包),解压后自带ComfyUI本体、常用插件和一批基础模型,启动后直接在浏览器里操作,门槛低很多。我的建议是:如果你准备长期投入,可以先用整合包把流程跑通,熟悉之后再看官方仓库的更新机制;如果你需要频繁测试最新功能,也可以考虑原生安装。
注意:无论哪种安装方式,出图速度与显存强相关。8GB以上显存可以流畅运行多数场景,6GB以下建议优先用512x512或者SD1.5这类小模型。遇到"CUDA out of memory"时,不要硬撑,先降分辨率、降批次,再考虑升级显卡。
3.2 搭建基础文生图工作流的五步
第一次搭工作流,目标只有一个:稳定出图。按下面的顺序把节点接起来:
- 添加并配置CheckpointLoaderSimple,选择底模。新手建议先用SD1.5系模型,文件体积小、生态兼容性强。
- 添加两个CLIPTextEncode节点,分别接正向和负向提示词。负向提示词里可以放"低清晰度、手指畸形、多余肢体"等常见问题。
- 添加EmptyLatentImage,设置尺寸为512x512,批次先设为1。
- 添加KSampler,使用默认的DPM++ 2M Karras,步数20-30,CFG值7。
- 添加VAEDecode和SaveImage,把结果输出出来。
连线的顺序是单向的:从加载器输出模型,接入提示词编码和采样器;提示词编码结果接入采样器的正向和负向条件;空潜空间图接入采样器的潜在图像输入;采样结果经VAE解码后保存。跑通后你会看到浏览器弹出图片,这说明整套管线没有断裂。这一步完成后,再慢慢调参数。
3.3 图生图与局部重绘:把PS的部分活儿提前
基础文生图跑通后,下一步强烈建议做图生图。数据流的区别很简单:把EmptyLatentImage换成LoadImage,再插入一个VAEEncode节点,把输入图转成潜空间表示。这样你可以对一张实拍照片做风格迁移、构图延展、细节修正。局部重绘更实用:用Mask编辑器或者其他Inpaint节点,指定图片里要改动的区域,配合提示词让模型只重构这块区域。商业应用中,客户给了实拍图想换背景、去杂物、改局部颜色,这些以前要在PS里花一两个小时抠图的活,现在可以在ComfyUI里先完成八九成,PS只需要做最后的过渡和校色。
3.4 LoRA与ControlNet:商业可控生成的两大支柱
如果只靠底模和提示词,生成结果的随机性很难满足商业要求,必须引入LoRA与ControlNet。LoRA是一种轻量化的模型微调方案,它不替换底模,而是作为一个附加模块加载,用来锁定特定画风、角色或物体特征。用LoRALoader节点加载后,接入模型管线即可。在实际项目中,我常用LoRA做"品牌风格锁定",让同一客户的不同订单保持统一的视觉基因。ControlNet则通过额外的条件输入约束生成,常见的条件包括Canny边缘图、深度图、OpenPose姿态骨架、语义分割图、线稿等。以电商场景举例:客户要求模特站在咖啡店门口、手拿产品、画面留出右侧文案区域,如果用提示词去描述,成功率很低;但只要用OpenPose控制姿态骨架、用深度图约束背景空间关系,再组合LoRA锁定画风,基本可以做到"按构图要求批量出图"。ControlNet节点的工作方式是输入一张条件图,经过ControlNet模型处理后,把约束信息注入采样过程,具体的参数调节需要一点实验积累,但它的价值是让"按需生成"变得可行。
4. 与PS的配合:AI生成之后的精修流程
4.1 AI直接交付还差什么
我见过很多新手把ComfyUI生成的图直接发给客户,结果就换来一堆修改意见。AI生成图常见的问题包括:手部结构变形、文字符号错误、边缘发毛、色彩溢出、分辨率不达标、细节经不起放大。这些不是模型"不够聪明",而是扩散模型本身的概率性特征。PS存在的意义不是把图"改真",而是把图"做稳":清除明显瑕疵、统一色彩、保证输出规格。绝大多数商业项目要的不是"最惊艳但随机"的图,而是"稳定达到良好水准"的图。
4.2 PS精修四步法
我自己在PS里的处理流程已经固定成四步,每张图控制在15分钟左右。第一步是打开与色彩校正,先用Camera Raw滤镜检查白平衡和曝光,把偏色拉回来,这一步解决的是AI图最常见的"色彩偏灰、偏冷"问题。第二步是结构瑕疵清理,用污点修复画笔、修补工具、内容感知填充,处理手指、眼睛、衣领、边缘杂色等局部问题,AI图的问题往往小而多,不要每个都用画笔重画,优先用工具自动修复。第三步是尺寸与分辨率调整,网络配图设置为72DPI,商用印刷设置300DPI,宽度根据交付平台要求设定,注意锁定长宽比。第四步是图层整理与导出,将处理过程拆分成不同图层并命名,保留一份PSD源文件,再导出JPG和透明底PNG各一份。这四步做完,一张图才算真正具备交付条件。
4.3 从单张精修到批量化处理
单张精修练熟了,就要想怎么批量做。PS的"动作"面板和"批处理"功能非常适合和ComfyUI配合:ComfyUI批量出图后,先按命名规则统一导出到固定文件夹,PS用录制好的动作自动执行白平衡校正、尺寸调整、基础锐化,把重复劳动交给电脑。遇到需要人工判断的瑕疵,再手动处理。这样一条流水线下来,我做过最大的一个批次是80张电商详情页素材,ComfyUI生成加PS批量处理,两个工作日完成,这个效率在传统流程下很难想象。
4.4 文件归档是商业协作的自我修养
商业项目里最容易被忽略的是文件管理。我的归档规范是三层结构:项目名、批次、终稿。终稿文件夹内统一放三种格式:PSD源文件、RGB预览JPG、透明底PNG。同时,在项目根目录放一份"参数记录表",写清该批次用了哪个底模、哪些LoRA、哪些ControlNet、种子范围、关键提示词。这套习惯让我在项目交付半年后,还能快速找回当时的生成配置,也方便复盘哪套参数在哪个项目里最稳。很多客户后期要求"再出一版XX风格的图",我翻参数记录表就能直接复用。
5. 商业落地:让工作流真正赚钱
5.1 四条已验证的变现路径
先说结论:AI绘画商业化的核心不是"卖一张图",而是"卖能力"和"卖流程"。我实践过比较顺畅的路径有四条。定制化图像服务,在社交平台或者接单平台接定制头像、壁纸、插画需求,ComfyUI批量生成候选,客户选定后PS精修,单量上来了收益自然可观。电商视觉升级,针对电商平台的商品主图、详情页素材做AI场景合成、模特换装,这类需求单价不高但复购快,更适合走量。自媒体内容代做,帮账号主批量生成封面图、配图、海报模板,按月套餐收费,核心卖点是"稳定交付+风格统一"。工作流模板售卖,把调试好的ComfyUI工作流、参数策略、PS动作打包成模板工具包,配套教程文档出售,适合已经有技术积累、想放大影响力的人。
5.2 用真实数字算一笔账
以电商产品场景图为例:传统方式找摄影师实拍加棚拍加后期,一个系列至少3天,费用成本高昂;用ComfyUI出场景候选、PS精修,通常1到2天就可以交付一组质量稳定的图。我接过的一个宠物零食品牌项目,需要40张产品场景图,实际从建模到交付用了一个半工作日,其中ComfyUI出了大约100张候选图,我选出40张,每张PS精修平均15分钟。如果全部人工拍摄后期,这个量可能要一周。当然,AI不是无条件替代摄影,前期还是要准备产品实拍原图,但时间成本和创意试错成本都大幅压缩了。
5.3 版权红线与交付合规
商业落地最容易翻车的是版权问题。一方面,使用的底模、LoRA、ControlNet要确认是否允许商用,很多个人训练的模型明确标注"仅学习交流,禁止商用",碰到这种就换一个来源清晰的模型。另一方面,要保留完整的生成链路记录:底模来源、模型版本、LoRA名称、采样器参数、提示词、ControlNet条件图、PS处理过程。这不是形式主义,而是万一客户追问"到底是不是原创"时,你能拿出完整的证据链证明自己的智力投入和工具使用范围。我的做法是每个项目建一个"元数据"文档,随时可查,既保护自己,也让客户放心。
6. 常见问题与排查技巧实录
6.1 显存不足与出图速度慢
ComfyUI最大的硬件门槛是显存。"CUDA out of memory"几乎每个新手都会遇到。遇到时按顺序排查三件事:把分辨率降到512x512、把批次调到1、关闭后台占用显存的其他程序。如果还不够,检查采样器类型,日常批量出图用效率型采样器(如DPM++ 2M),慎用画质追求型(如DPM++ SDE),同样的步数下速度差异明显。如果模型本身就大(比如SDXL系列),可以试试显存优化参数或者拆分部分计算到CPU。显存不足时不要盲目升级显卡,先用小模型跑通流程,理解瓶颈后再决定投入。
6.2 手部崩坏与脸部变形
手部问题几乎成了AI绘画的"招牌笑点"。处理手段分三步:第一步,负向提示词里写清楚bad hands、missing fingers、extra fingers,降低出错的概率;第二步,构图层面避开特写手掌,多使用手插兜、拿杯子、握手机这类动作;第三步,引入ControlNet手部骨架模型,给定手部姿态后再生成。如果局部仍然有问题,在ComfyUI里做一次局部重绘,或者拖到PS用修补工具修复。商业交付中,我通常会在选图环节直接淘汰结构问题明显的手部特写,不把修复成本浪费在容易出错的构图上。
6.3 批量图色彩不一致与风格漂移
同一个项目里生成几十张图,最怕出现"每张都好看但放一起风格不统一"。想解决这个问题,要在ComfyUI阶段就做"参数锁定":固定同一个底模、同一个LoRA、相近的种子范围,尽量让采样参数一致。进入PS后,用图层匹配或Color Lookup调整层把所有成图统一到同一色彩基准。我习惯以第一张选定的图作为"色彩基准图",后面每张都拿它做参照,用调整图层逐张对齐,最后再批量导出。这样出来的整套图,才能让客户觉得是"一个系列的成品"。
6.4 PS与ComfyUI联动时的文件细节
ComfyUI默认保存的PNG可能是sRGB,而PS新建文档的工作空间可能是Adobe RGB或其他,两者切换时容易产生颜色偏暗。解决办法很直接:把PS的颜色设置统一改为sRGB,ComfyUI导出时也确认色彩空间一致。需要透明底时,注意保存格式要包含Alpha通道,并在ComfyUI里确认背景不是纯白填充。另外,如果ComfyUI生成的图在PS里打开很模糊,检查一下是不是分辨率被人为缩小了,批量出图时不要把图像缩放节点接在保存节点之前,除非你有明确的缩图需求。
6.5 常见问题速查表
| 问题现象 | 大概率原因 | 最快处理方式 |
|---|---|---|
| CUDA out of memory | 显存不足 | 降低分辨率、批次为1、开低显存模式 |
| 出图很慢 | 采样器类型或步数过高 | 换DPM++ 2M,步数控制20-30 |
| 手部崩坏 | 模型概率性失误 | 负向提示词+ControlNet手部骨架 |
| 整批色彩不一致 | 种子/模型未锁定 | 固定底模、LoRA、种子,PS统一校色 |
| PS打开偏暗 | 色彩空间不一致 | 统一sRGB |
| 透明底变白底 | 保存未包含Alpha | 使用带透明通道的格式并检查背景 |
这个表适合打印出来贴在工位上,遇到问题时先按表排查。
最后分享一点个人体会:我刚开始用ComfyUI时,也走了不少弯路,总想把每个节点都研究透再开工,结果耗在"看教程"上的时间比实际出图还多。后来转变方式,先找一套成熟模板跑通,再逆向拆解理解节点逻辑,进步反而快得多。这套ComfyUI+PS的组合工作流,核心思想就是"可控、可复用、可交付",只要围绕这三个词去优化自己的流程,不管工具怎么更新换代,思路都不会过时。希望这篇实战拆解,能让你少走一点我走过的弯路。