Open Generative AI:400+模型AI图像视频生成工作室,可自托管无过滤
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
你大概也遇到过:商用AI视频平台按月收订阅费,提示词还要过一遍内容过滤器,碰巧敏感就拒掉。Open Generative AI 是一个开源、可自托管的AI图像与视频生成工作室,Flux、Midjourney、Kling、Sora、Veo 等 400 多个模型集中在一个界面里,不设任何内容过滤器。
项目速览
- MIT 协议,免费开源
- 400+ 模型,覆盖 8 大类别
- 14 个工作室:图像、视频、音频、唇形等
- 无内容过滤,提示词不被拒
- Web、桌面应用、自托管三种用法
- 本地推理:sd.cpp + Wan2GP 双引擎
- 多参考图输入,单请求最多 14 张
三步上手
- 装:桌面版直接下预编译包(macOS DMG / Windows exe / Linux AppImage 和 .deb);源码方式则执行
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI - 配:源码运行先
npm run setup(装依赖并构建 workspace 包,只跑npm install不够),再npm run electron:dev起桌面端或npm run dev起 Web 端(localhost:3000);云模型要填 Muapi API Key,纯本地模型不需要 - 出结果:打开 Image Studio,选模型、写提示词、点生成;桌面端在 Settings → Local Models 里一键装 sd.cpp 引擎后,本地出图不联网
核心能力拆解
怎么从一句提示词生成视频
Video Studio 默认是文本转视频模式,写场景描述就能出片,这是短视频批量产出的基本盘。
- 40+ 文生视频模型:Kling、Sora、Veo、Wan、Hailuo、Runway 等
- 画幅、时长(5/10/15 秒)、质量选项随模型能力自动适配
- 生成实现见 VideoStudio.jsx
怎么把静态图变成视频
上传一张起始帧图片,工作室自动切到图生视频模式,把静图动起来,此时提示词变为可选。
- 60+ 图生视频模型:Kling I2V、Veo3 I2V、Wan I2V、Midjourney I2V 等
- 图/视频两种模式按"是否上传参考图"自动切换,不用手动选
- 上传过的图会存进本地历史,下次直接复用,不用重复上传
怎么给角色加口型
Lip Sync Studio 专做"让嘴型对上音频"这件事,9 个专用模型分两种输入组合。
- 肖像图 + 音频 → 说话视频:Infinite Talk、Wan 2.2、LTX Lipsync 等 4 个模型,480p 到 1080p 可选
- 现有视频 + 音频 → 重新对口型:LatentSync、Veed 等 5 个模型
- 逻辑见 LipSyncStudio.jsx,任务刷新页面后自动续跑
怎么控制电影级镜头
Cinema Studio 把摄影参数翻译成提示词修饰符,出片前就能锁定镜头语言。
- 6 种机身(16mm 胶片到 8K 数字)、12 种镜头、8mm 到 85mm 六档焦距
- f/1.4 浅景深、f/4 均衡、f/11 前后都实,三档光圈
- 官方素材里每张镜头效果都有参考图,选参数前先预览
实际怎么用
15 秒带货短视频。你要给咖啡店做条宣传片段。Video Studio 里选 Seedance 2.0,描述"咖啡注入浓缩咖啡,热气上升,浅景深,10 秒,16:9",先出一版;不满意就换 Hailuo 2.3 再生成一版对比。两三次迭代就能拿到能直接发布的成片。
数字人口播对口型。有一段 15 秒产品口播音频和一张主播肖像。切到 Lip Sync Studio 的 Portrait 模式,上传肖像图 + 音频,选 LTX 2.3 Lipsync 的 720p,人物嘴型会跟着音频走。如果手头是拍好的真人视频,切 Video 模式传视频 + 音频即可,不用重拍。
拍摄前的电影感概念图。筹备拍摄时你想先定色调。Cinema Studio 选 Grand Format 70mm Film 机身、85mm 镜头、f/1.4,写一句场景描述,出图自带胶片颗粒和浅景深氛围,可以直接给摄影组当色彩和构图参考。
技术栈一句话
- Next.js(App Router):Web 自托管版和 API 代理层
- Electron + Vite:桌面应用,本地推理引擎也跑在这里
- Tailwind CSS v3:实用优先样式,深色玻璃拟态界面
- npm workspaces:单仓库,packages/studio 库被 Web 端和桌面端共用,模型定义改一处两边生效
- Muapi.ai:400+ 模型的统一 API 网关,提交 → 轮询两步协议
踩坑与技巧
- macOS 首次打开被 Gatekeeper 拦截(应用未签名),跑一次
xattr -cr清掉隔离属性即可,之后正常 - 8GB 内存的 M 系 Mac 别跑 Z-Image,README 明确说会卡死系统,用 2.1GB 的 SD 1.5 模型
- Ubuntu 24.04+ 上 AppImage 打不开,换 .deb 包安装,里面自带 AppArmor 配置
- 源码环境报"找不到 pages 目录",基本是 submodule 没拉全,回到仓库根目录重跑
npm run setup - Wan2GP 不是本地引擎而是远程服务:你得先在 CUDA/ROCm 的 GPU 机器上跑它的 Python 服务,桌面端只发提示词
谁适合用
- 短视频与电商创作者:文生视频、图生视频多模型 A/B 对比,单条 5-15 秒快速出片
- 在意隐私的本地推理用户:M 系 Mac 上用 sd.cpp 跑 SD 1.5,图像生成完全不经过外部 API
- 想改造分发的人:MIT 协议,packages/studio 是独立组件库,UI 和模型网关都能换
如果你只是偶尔出几张图,官方托管的 Web 版免费用就够了,不用装任何东西。
更多细节见仓库内的 README.md。把三步上手的命令从头跑一遍,10 分钟内你就能拿到第一段 AI 视频。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考