Open Generative AI:免费开源的AI视频生成工作室,400+模型可本地部署
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
短视频创作者和影视制作人用商业AI视频平台时,常被三件事卡住:订阅费月月涨、提示词被内容过滤器拦截、素材数据在别人服务器上。Open Generative AI 就是一个为此而生的开源AI视频生成平台——不订阅、不拦提示词,还能整个部署在你自己的机器上。
项目本身叫 Open Generative AI,免费、MIT 许可证、完全开源。它把图像、视频、唇形同步、电影镜头控制等功能做成 14 个"工作室",背后接入了 400+ 个模型(README 中按类别合计 420+),包括 Flux、Midjourney、Kling、Sora、Veo、Seedance 2.0、Hailuo 等。部署方式有三种:浏览器在线版、Electron 桌面应用、自己从源码跑起来。
装好后能干什么:先过一遍工作室清单
一句话:图像、视频、声音、镜头、流程,每个方向都有独立入口,不用在十几个网站之间来回切。
- 🎬视频工作室:默认是文生视频模式(85+ 个模型);上传一张起始帧后,自动切换成图生视频模式(120+ 个模型)。核心实现在 src/components/VideoStudio.js。
- 图像工作室:同样的双模式设计,文生图 70+ 个模型,上传参考图后切到图生图 70+ 个模型;兼容模型最多支持一次传入 14 张参考图。
- 唇形同步工作室:人像图+音频生成说话视频,或现有视频+音频重新对口型,共 9 个专用模型。适合做配音和多语言版本,实现在 src/components/LipSyncStudio.js。
- 🎥电影工作室:提供虚拟摄影机控制——相机(模块化 8K 数字机、大画幅胶片等)、镜头(变形宽银幕、微距等)、焦距(8mm~85mm)和光圈(f/1.4、f/4、f/11),这些选择会被转成优化后的提示词修饰符,而不是简单拼词。
- 工作流工作室:节点式拖拽编辑器,把图像、视频、音频模型串成多步骤流程;有模板库、社区工作流和交互试运行,工作流本身也能通过 API 调用。
- 其余:音频生成、长视频自动剪辑(AI Clipping)、风格化动效(Vibe Motion)、换装/换人(Recast)、营销素材批量变体、Agent 对话式生成等,入口都在侧边栏里。
不想装环境:三种跑起来的方式
结论:多数人不需要写一行代码,按自己的习惯挑一种即可。
- 📥在线版(最省事):官方提供托管 Web 版,浏览器打开就能用全部工作室,不用装 Node.js,注册免费账号即可开始生成。
- 桌面应用(推荐日常使用):从 Release 页下载预构建安装包——macOS 是 DMG(Intel 和 Apple Silicon 各一个)、Windows 是 NSIS 安装包、Linux 有 AppImage 和 DEB。macOS 首次打开会被 Gatekeeper 拦一下(未做公证),按 README 里的
xattr -cr命令处理一次即可;Windows 的 SmartScreen 警告点"仍要运行"就行。 - 源码自托管(给开发者):需要 Node.js 18+,克隆仓库后装依赖并启动:
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup # 安装依赖 + 构建 workspace 子包,必须执行 npm run dev # Web 版,访问 http://localhost:3000 # 或 npm run electron:dev 启动桌面版仓库里还带了 Dockerfile 和 docker-compose.yml,想丢到服务器上长期跑也行。注意npm install单独跑不够,必须走npm run setup,否则工作区子包没构建,页面起不来。
谁适合用
不是所有项目都合适,对号入座:
- 短视频/自媒体创作者:要快速出片、批量出变体,又不想给平台交月费。
- 配音与本地化团队:唇形同步工作室可以直接把一条口播翻成多语言口型。
- 有 GPU 的个人开发者:想在自家机器上跑推理、数据不出内网,本地推理是桌面版独占能力。
- 想二开的人:MIT 许可 + Next.js 单仓结构,模型列表就是一个 JS 数组,加模型、改界面都是显性改动。
- 不太适合的:只想要"点一下出片"且不想碰任何配置的人,商业平台的开箱体验仍然更顺滑。
怎么用好:本地推理与几条实战经验
结论:云端模型靠 API key,本地模型靠硬件,两条路可以混着走。
- 🔑API 密钥:首次使用会提示填 Muapi.ai 的密钥(存浏览器 localStorage,只发给 Muapi)。如果你只用桌面版的本地模型,可以完全不填 key。
- 🔧本地推理两个引擎(仅桌面应用可用,设置 → Local Models 里配置):
- sd.cpp:随应用捆绑,跑图像模型(SD 1.5、SDXL、Z-Image)。Apple Silicon 上有 Metal 加速,Linux/Windows 上走 CUDA/Vulkan/ROCm。
- Wan2GP:需要你在一台有 CUDA/ROCm GPU 的机器上自跑 Wan2GP 服务,桌面端填 URL 连过去。这样 Mac 用户也能把视频模型(Wan 2.2、Hunyuan、LTX)的推理丢给局域网里的显卡主机。
- 内存红线:Z-Image 系列需要约 16GB 内存,8GB 的 M 系列 Mac 上会直接卡死系统,老老实实用 SD 1.5 小模型。
- 省流提示词:描述越具体越好;给图生视频时上传一张构图好的起始帧,比堆提示词管用;出片慢就先降分辨率再换轻量模型。
- 历史与复用:上传过的参考图会存在本地历史里,下次直接点选不用重新传;生成记录也存在浏览器本地存储,可以回看和下载。
怎么接入:API 与工作流
结论:接口是"提交+轮询"两段式,工作流本身也是可调用的,方便往自己的产品里嵌。
- 生成请求的流程:POST 到模型端点提交提示词和参数,拿到
request_id后轮询结果接口,直到状态变为完成;鉴权用x-api-key请求头。整个客户端封装在 src/lib/muapi.js,想自己写后端集成可以参考它的时序。 - 工作流 API:Workflow Studio 里存的每条流程都可以通过 Muapi API 触发执行,适合把"文生图 → 图生视频 → 剪辑"这类链条自动化。
- 自定义扩展:模型清单集中在 packages/studio/ 的
models.js,加一个模型就是加一条记录;界面是标准 React 组件,替换和裁剪都比较直接。更深的技术说明可以看仓库里的 docs/ 和project_knowledge.md。
你大概率会问的几个问题
- 不安装能用吗?能,在线版全部功能都在浏览器里,注册即可生成。
- 本地推理需要什么硬件?最低 8GB 内存(只跑 SD 1.5 级别的小模型),推荐 16GB;视频类本地模型需要另备一台 CUDA/ROCm GPU 机器跑 Wan2GP。
- 生成失败或特别慢怎么办?先检查网络和 key,然后降分辨率、换轻量模型;Apple Silicon 上确认走的是 Metal 而不是 CPU。
- 能商用吗?软件本身是 MIT 许可证,可以商用、修改、分发;但云端接的那些第三方模型各自有使用条款,商用前按对应模型的要求走一遍。
下一步
- 先用在线版把图像工作室和视频工作室各跑一遍,感受双模式切换,再决定要不要装桌面版。
- 有 Mac 或独显的,装好桌面应用后在"设置 → Local Models"里装一次 sd.cpp,用一张图验证本地推理通了。
- 有自动化需求的,把一条常用的"文生图→图生视频"链建成工作流,试试 API 调用。
提醒一句:Open Generative AI 本身是 MIT 许可,随意商用;但云端模型(Flux、Sora、Kling 等)各有自己的条款,正式对外商用前记得核对一遍。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考