Open Generative AI:把 400+ 个 AI 模型装进本地,完整跑通图像与视频生成
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open Generative AI 是一个完全开源的 AI 图像与视频生成工作室:内置 Flux、Midjourney、Kling、Sora、Veo 等 400+ 模型,无内容过滤、无订阅费,MIT 协议、可自托管。本文讲清它能干什么、两种本地推理引擎怎么选,以及如何用 3 条命令把它跑起来。
为什么要自己搭一个"模型超市"
商业 AI 创作平台大多有三个共同点:按月收费、提示词要过审、源码不开放。Open Generative AI 把这三点全部反过来:
- 开源:MIT 协议,模型清单集中在 packages/studio/src/models.js 一个文件里,想加模型、改界面都直接改代码;
- 无内容过滤:提示词不会被拦截或改写,写什么就送去模型跑什么;
- 自托管:数据留在自己机器上,API Key 只存在浏览器 localStorage 里。
值得注意的一点:Web 版和桌面版共用同一份模型定义,模型一更新,所有入口同时生效,不用维护多套配置。
14 个工作室,从哪几个开始用 🎯
装好应用后你会看到 14 个工作室。不用全碰,按任务对号入座即可:
| 你要做的事 | 用哪个工作室 | 一句话说明 |
|---|---|---|
| 文生图 / 改图 | Image Studio | 上传参考图后自动在 t2i 与 i2i 两套模型间切换 |
| 文生视频 / 图生视频 | Video Studio | 85+ 文生视频、120+ 图生视频模型 |
| 让照片开口说话 | Lip Sync Studio | 9 个模型,支持"肖像+音频"和"视频+音频"两种模式 |
| 批量自动化 | Workflow Studio | 节点式拖拽编排,内置社区模板,工作流还能直接走 API 调用 |
| 电影感出片 | Cinema Studio | 镜头、焦距、光圈等相机参数直接拨 |
一个容易被忽略的细节是多图融合:Nano Banana 2 Edit、Flux Kontext Dev 这类模型一次最多吃 14 张参考图,上传选择器带顺序编号,且你上传过的图会自动存进历史记录,下个会话直接复用,不用重复传。
本地推理双引擎:按你的硬件选 ⚡
本地推理是桌面版的招牌能力——不用 API Key 也能出图出视频。它拆成两个独立引擎,在"设置 → Local Models"里分别配置:
sd.cpp:打包内置,图像模型本地跑
这是随应用一起分发的 C++ 推理引擎,直接在你这台机器上跑:Apple Silicon 走 Metal GPU,Linux/Windows 走 CUDA、Vulkan 或 ROCm。覆盖 SD 1.5、SDXL 和 Z-Image 系列。Dreamshaper 8 这类 SD 1.5 模型只有约 2.1 GB,8GB 内存的机器也能转;Z-Image 就比较吃内存了,README 明确建议 16GB RAM,8GB 机器上已知会卡死,老老实实用 SD 1.5。
Wan2GP:自备 GPU 服务器,跑重的
Wan2GP 是你在另一台带 CUDA/ROCm GPU 的机器上自跑的服务,应用只负责发提示词、收结果。Flux.1 Dev、Qwen Image 以及 Wan 2.2、Hunyuan、LTX 这类视频模型都走这条路。妙处在于:只有 Mac 的人也能用——应用在 Mac 上开着,推理丢给局域网里那台游戏 PC 或租来的 GPU 实例。
调度逻辑在 electron/lib/localInference.js,想接入第三种引擎可以从这里入手。
从克隆到出图,3 条命令搞定
不想碰代码的话,桌面版提供 macOS、Windows、Linux 的预编译安装包,直接下载即可。开发者自托管只有四步:
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup # 装依赖 + 构建 workspace npm run dev # Web 版;桌面版用 npm run electron:dev--recurse-submodules不能省:工作流和 Agent 相关包在子模块里,npm run setup会顺带构建这些 workspace,漏掉就会报"找不到 pages 目录"的错误。想直接上生产环境,仓库里的 docker-compose.yml 也够用。
Cinema Studio:把 AI 生成当真实拍摄来调 🎬
如果你是拍片出身,Cinema Studio 会很有亲切感:它不让你往提示词里堆"电影感"这种玄学词,而是把电影感拆成一排能拨的旋钮。
| 参数 | 选项 | 影响 |
|---|---|---|
| 机身 | Modular 8K、70mm 大画幅、16mm 胶片等 | 画面整体质感 |
| 镜头 | 70s Cinema Prime、Swirl Bokeh 等 11 种 | 光学特性与虚化形状 |
| 焦距 | 8mm–85mm | 从超广角透视到紧肖像 |
| 光圈 | f/1.4 / f/4 / f/11 | 浅景深到深焦 |
选择会被翻译成提示词修饰符,出来的东西像"拍出来的",而不是"渲染出来的"。仓库里附了每种参数组合的官方示例成片,调参前先对一眼答案:
下一步
如果你想要一个不订阅、不过滤、数据在本地手里跑的 AI 生成环境,Open Generative AI 值得花一个晚上试:下载桌面安装包,或者用上面的命令起一个 Web 版。代码是 MIT 协议的,读、改、加模型都随意。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考