Pixelle-Video AI 短视频生成上手指南:从一个主题到成片
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
周三下午两点,运营群里又催了一版一分钟的产品口播视频,要求当天发出。写文案、配插图、录解说,这三件事要在一个下午从零开始做,基本不现实。这种时候,Pixelle-Video AI 短视频生成能派上用场:输入一个主题,它自动完成文案、配图、配音和视频合成,把一句话的需求变成一个能直接交付的视频文件。
三分钟跑通最小流程
Pixelle-Video AI 短视频生成的最小流程只有四步,读者只需提前装好 uv 和 ffmpeg(各系统的安装命令在 docs/zh/getting-started/installation.md 里)。
- 克隆仓库并启动,第一次
uv run会自动装好全部依赖:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py- 浏览器打开
localhost:8501后,展开顶部「系统配置」。最少要配两项:LLM(选一个模型预设并填 API Key)和图像生成(填本地 ComfyUI 地址或 RunningHub Key)。 - 左侧栏切到「AI 生成内容」,输入一个主题,比如「为什么要养成阅读习惯」,其余参数保持默认。
- 右侧点「生成视频」。默认 5 个分镜大约需要 2-5 分钟,完成后视频自动播放,文件保存在
output/目录。
它到底做了什么:拆成四步看
点下生成之后,Pixelle-Video AI 短视频生成流水线里发生的事情可以拆成四步:
- 文案:LLM 先把主题拆成若干分镜脚本(默认 5 个分镜),同时生成视频标题和每个分镜的配图提示词,逻辑在 pixelle_video/utils/content_generators.py。
- 配图:每个分镜的提示词交给配置好的图像模型(Flux、Qwen 等)逐张出图,尺寸由配置决定。
- 配音:默认 Edge-TTS 把脚本读成音频,音频时长直接决定该分镜在片中的停留时间。
- 合成:画面、字幕和音频按模板排进帧里,逐段渲染成片,最后拼接并混入背景音乐,入口在 pixelle_video/pipelines/standard.py,拼接由 pixelle_video/services/video.py 负责。
换风格、换尺寸、换语言
模板按尺寸分了三组:
| 模板尺寸 | 适配平台 | 代表模板 |
|---|---|---|
| 1080x1920 竖屏 | 抖音、快手、小红书 | image_default、image_healing |
| 1920x1080 横屏 | B 站、YouTube、视频号 | image_film、image_full |
| 1080x1080 方形 | Instagram、小红书信息流 | image_minimal_framed |
先试两个风格:film 电影风格适合横屏的产品展示和解说类内容,healing 治愈风格适合情感、生活感悟类内容。语音支持多语言音色,同一段脚本换个语言就能换个声音读出来,同一内容做多语言版本不用重做。
全部模板在 templates/ 目录,按尺寸分子目录存放,按文件名翻就行。
让生成质量再进一步
对成片影响最明显的有三个参数:
- 分镜字数:默认每镜 5-20 字,建议取 10-20 字;太短视频节奏赶,太长单镜音频拖过 10 秒,观感会差。
- 分镜数量:默认 5 个;一分钟的视频取 3-5 个比较稳,分镜越多,逐镜出图和配音的次数越多,总耗时会按比例拉长。
- 图像尺寸:默认 1024x1024;用竖屏模板时改成竖版比例,避免模板裁掉画面。配图的整体风格由提示词前缀控制(默认是极简黑白火柴人风格),改完建议先点「预览风格」再重新生成。
这些都能写进配置文件固化下来,参考 config.example.yaml。
谁在用它、能用到什么程度
- 短视频账号运营:每天早上一句产品主题进流水线,中午挑好三个竖屏成片直接排期上传。
- 企业内训制作:把课程要点作为固定文案粘进去,每讲生成一段课前引导视频,省掉录音环节。
- 电商运营:把自己现有的产品照片和视频传进「自定义素材」流程,AI 分析后生成匹配文案和成片,素材不用重拍。
遇到问题时先查这三处
- 文案生成直接报错:先核对 LLM API Key 是否填对、账户是否有余额,再看错误信息里的具体原因 → 故障排查。
- 配图生成失败:先确认 ComfyUI 服务在跑,浏览器打开它的地址试试;连不上就查 URL 配置和防火墙 → 故障排查。
- 成片看着不对味:别一次改所有设置,每次只换一个变量重新生成——换 LLM 模型看文案、换模板看画面、换 TTS 音色听声音,对比定位是哪一步的问题 → FAQ。
下次再被催一版一分钟的视频,先把主题丢进 Pixelle-Video 出一版默认风格的看底线,再把 config 里的 default_template 换成横屏模板重跑一次,两版一起带到会上选一个。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考