【ComfyUI】QwenImageEdit 连续式叙事分镜图生图
2026/9/18 4:04:25 网站建设 项目流程

今天给大家演示一个基于ComfyUI的电影级分镜图生成工作流。本工作流利用Qwen多模态模型NextScene镜头衔接Lora模型,结合用户输入的一张参考图像和剧情提示语,自动生成风格统一、连贯叙事、构图电影感强烈的多张分镜图像


通过强大的多模态理解与画面衔接能力,模型能够保持人物外观、动作、光影、背景一致性,极大地简化了影视概念图、分镜设计、短视频策划等创意工作流程。

文章目录

  • 工作流介绍
    • 核心模型
    • Node节点
  • 工作流程
  • 大模型应用
    • RH_LLMAPI_NODE 分镜级微电影叙事生成核心
    • TextEncodeQwenImageEditPlus(正向) 图像编辑与风格强化正向语义
    • TextEncodeQwenImageEditPlus(负向) 稳定构图与画面清洁的负向语义
    • CLIPLoader(文本模型加载器) 语言理解能力供给节点
  • 使用方法
  • 应用场景
  • 开发与应用

工作流介绍

本工作流聚焦于“镜头风格一致性”的影视剧情分镜制作。通过加载一张参考图片,结合剧本提示,由大语言模型生成对应的分镜描述,再由图像模型渲染出风格连贯的图像序列。核心亮点在于结合多重 LoRA 微调模型,强化角色、光影、服饰等视觉连贯性,最终输出高质量、可用于视频分镜头脚本的图像序列。

本流程中的模型体系搭建合理,分为三个核心组成:基础模型、LoRA增强模块和CLIP多模态编码器。各节点之间通过精准的图像与文字信息流传递,实现从“参考图 + 描述”到“高质量图像输出”的完整自动流程。

核心模型

本工作流在核心模型部分采用了由 Qwen 出品的图像编辑模型,结合 NextScene 镜头推进 Lora 与 Lightning 风格强化 Lora,三者配合确保画面衔接自然、镜头感真实。

模型名称说明
Qwen-Image-Edit-2509_fp8_e4m3fn主体图像编辑核心模型,负责整体画面生成
next-scene_lora_v1-3000.safetensors强化镜头衔接与分镜推进的连续性,保留场景构图

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询