不花钱调 API、没有独显,Open Generative AI 本地部署怎么从零跑起来?
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
想用 AI 生图生视频,又不想按月付费调 API、手头还没有一张独立显卡?Open Generative AI 是一个可自托管的开源 AI 生成工作室:400 多个 Flux、Midjourney、Kling、Sora、Veo 这类模型接在一个界面里,本地部署后数据不出自己的机器,MIT 协议。它内置的 sd.cpp 引擎走 CPU 也能出图,对无独显用户是真正的完整方案。
它到底能干什么
一句话:把图像、视频、音频生成和后期流程整合到一个自托管工作室里,给个人创作者和小团队用。最不同的两点是没有任何内容过滤,以及桌面版自带本地推理引擎。核心模块:
- 图像工作室:文生图和图生图双模式,上传参考图后模型列表自动切换
- 视频工作室:文生视频,或给一张首帧图让它动起来
- 唇语同步工作室:人像图或已有视频配一段音频,输出口型匹配的视频
- 电影工作室:镜头、焦距、光圈三组参数控制画面质感
- 工作流工作室:把多个模型拖成节点串成自动化流水线
macOS、Windows、Linux 桌面版安装步骤
最省事的路径是装桌面版,不用碰终端装依赖。
macOS:装 Apple Silicon 版 DMG,拖进 Applications,首次打开会被 Gatekeeper 拦下,执行xattr -cr "/Applications/Open Generative AI.app"再打开即可。
Windows:运行 EXE 安装器。弹 SmartScreen 警告时点"更多信息",再点"仍要运行",装完在开始菜单有快捷方式。
Linux:AppImage 先chmod +x加执行权限再直接运行;或者装 .deb 包。Ubuntu 24.04 之后如果 AppImage 启动闪退,优先换 .deb。
先出图像,再出视频和同步视频
打开应用,进图像工作室,提示词框输入一句具体描述,选模型,点生成,得到第一张图。
把这张图传到视频工作室作为首帧,选一个图生视频模型,点生成,静图变成几秒的动态片段。
最后进唇语同步工作室:传一张人物照加一段音频,选 Infinite Talk 或 LTX Lipsync 这类模型,点生成,得到口型对上的人声视频。三个工作室都在侧边栏,流程就这么多步。
低配电脑怎么跑得动
桌面版内置 sd.cpp 引擎,就是 stable-diffusion.cpp 的 C++ 实现,普通 CPU 能跑,Apple 芯片上走 Metal 加速,设置里一键下载模型,不占系统目录。关键配置看内存:
- 8GB 内存:选 DreamShaper 8(SD 1.5,约 2.1GB),512x512 分辨率,12 到 20 步;Z-Image 权重加缓冲约 10GB,8GB 机器上会卡死系统
- 16GB 以上:可以上 Z-Image 或 SDXL Base,分辨率往高调
- 步数少 5 步,出图时间大致快三分之一,质量损失肉眼可接受
只跑本地模型可以不填 API key;要用云端模型列表才需要配置。
源码构建与自动化工作流
有 Node 18 以上环境就可以从源码构建,三条命令封顶:
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup装完依赖后npm run electron:dev启动桌面版,npm run dev起 Web 版访问 3000 端口。
想要批量生产就进工作流工作室:节点式编辑器把图像、视频、音频模型连成流水线,社区模板能直接拿来跑,playground 里交互调试,每个工作流还能通过 API 调用,方便接进自己的脚本。
踩坑速查
- macOS 首次打开被拦截:应用未经 Apple 公证。执行
xattr -cr "/Applications/Open Generative AI.app",或走系统设置的"仍要打开",只需一次。 - Windows SmartScreen 弹窗:安装程序无代码签名。点"更多信息"→"仍要运行"即可。
- Ubuntu 24.04+ 上 AppImage 闪退:AppArmor 限制 Chromium 沙箱。直接装 .deb 包,安装时自带 profile,不用改系统设置。
- 8GB 机器跑 Z-Image 卡死:模型内存需求约 10GB。换 DreamShaper 8 加 512x512。
- 报"Couldn't find a 'pages' directory":没在仓库根目录运行,或子模块没拉全。回到根目录重跑
npm run setup。
继续深挖去哪
- README:安装、模型清单、架构说明的完整出处
- packages/studio/src/:400 多个模型的唯一定义文件 models.js 和 15 个工作室组件都在这里
- electron/lib/:本地推理引擎的下载、路径、运行时逻辑
- src/lib/:上传历史、提示词工具等前端核心库
- Discord 社区:README 顶部有入口,提问和跟进版本更新
本地推理代码全在 electron 目录里,翻一遍就能搞清引擎怎么被拉起来。MIT 协议意味着你改完模型列表和界面,可以直接打包成自己的产品。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考