news 2026/9/9 18:19:42

Open Generative AI:400+模型AI图像视频生成工作室,可自托管无过滤

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Open Generative AI:400+模型AI图像视频生成工作室,可自托管无过滤

Open Generative AI:400+模型AI图像视频生成工作室,可自托管无过滤

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

你大概也遇到过:商用AI视频平台按月收订阅费,提示词还要过一遍内容过滤器,碰巧敏感就拒掉。Open Generative AI 是一个开源、可自托管的AI图像与视频生成工作室,Flux、Midjourney、Kling、Sora、Veo 等 400 多个模型集中在一个界面里,不设任何内容过滤器。

项目速览

  • MIT 协议,免费开源
  • 400+ 模型,覆盖 8 大类别
  • 14 个工作室:图像、视频、音频、唇形等
  • 无内容过滤,提示词不被拒
  • Web、桌面应用、自托管三种用法
  • 本地推理:sd.cpp + Wan2GP 双引擎
  • 多参考图输入,单请求最多 14 张

三步上手

  1. :桌面版直接下预编译包(macOS DMG / Windows exe / Linux AppImage 和 .deb);源码方式则执行git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
  2. :源码运行先npm run setup(装依赖并构建 workspace 包,只跑npm install不够),再npm run electron:dev起桌面端或npm run dev起 Web 端(localhost:3000);云模型要填 Muapi API Key,纯本地模型不需要
  3. 出结果:打开 Image Studio,选模型、写提示词、点生成;桌面端在 Settings → Local Models 里一键装 sd.cpp 引擎后,本地出图不联网

核心能力拆解

怎么从一句提示词生成视频

Video Studio 默认是文本转视频模式,写场景描述就能出片,这是短视频批量产出的基本盘。

  • 40+ 文生视频模型:Kling、Sora、Veo、Wan、Hailuo、Runway 等
  • 画幅、时长(5/10/15 秒)、质量选项随模型能力自动适配
  • 生成实现见 VideoStudio.jsx

怎么把静态图变成视频

上传一张起始帧图片,工作室自动切到图生视频模式,把静图动起来,此时提示词变为可选。

  • 60+ 图生视频模型:Kling I2V、Veo3 I2V、Wan I2V、Midjourney I2V 等
  • 图/视频两种模式按"是否上传参考图"自动切换,不用手动选
  • 上传过的图会存进本地历史,下次直接复用,不用重复上传

怎么给角色加口型

Lip Sync Studio 专做"让嘴型对上音频"这件事,9 个专用模型分两种输入组合。

  • 肖像图 + 音频 → 说话视频:Infinite Talk、Wan 2.2、LTX Lipsync 等 4 个模型,480p 到 1080p 可选
  • 现有视频 + 音频 → 重新对口型:LatentSync、Veed 等 5 个模型
  • 逻辑见 LipSyncStudio.jsx,任务刷新页面后自动续跑

怎么控制电影级镜头

Cinema Studio 把摄影参数翻译成提示词修饰符,出片前就能锁定镜头语言。

  • 6 种机身(16mm 胶片到 8K 数字)、12 种镜头、8mm 到 85mm 六档焦距
  • f/1.4 浅景深、f/4 均衡、f/11 前后都实,三档光圈
  • 官方素材里每张镜头效果都有参考图,选参数前先预览

实际怎么用

15 秒带货短视频。你要给咖啡店做条宣传片段。Video Studio 里选 Seedance 2.0,描述"咖啡注入浓缩咖啡,热气上升,浅景深,10 秒,16:9",先出一版;不满意就换 Hailuo 2.3 再生成一版对比。两三次迭代就能拿到能直接发布的成片。

数字人口播对口型。有一段 15 秒产品口播音频和一张主播肖像。切到 Lip Sync Studio 的 Portrait 模式,上传肖像图 + 音频,选 LTX 2.3 Lipsync 的 720p,人物嘴型会跟着音频走。如果手头是拍好的真人视频,切 Video 模式传视频 + 音频即可,不用重拍。

拍摄前的电影感概念图。筹备拍摄时你想先定色调。Cinema Studio 选 Grand Format 70mm Film 机身、85mm 镜头、f/1.4,写一句场景描述,出图自带胶片颗粒和浅景深氛围,可以直接给摄影组当色彩和构图参考。

技术栈一句话

  • Next.js(App Router):Web 自托管版和 API 代理层
  • Electron + Vite:桌面应用,本地推理引擎也跑在这里
  • Tailwind CSS v3:实用优先样式,深色玻璃拟态界面
  • npm workspaces:单仓库,packages/studio 库被 Web 端和桌面端共用,模型定义改一处两边生效
  • Muapi.ai:400+ 模型的统一 API 网关,提交 → 轮询两步协议

踩坑与技巧

  • macOS 首次打开被 Gatekeeper 拦截(应用未签名),跑一次xattr -cr清掉隔离属性即可,之后正常
  • 8GB 内存的 M 系 Mac 别跑 Z-Image,README 明确说会卡死系统,用 2.1GB 的 SD 1.5 模型
  • Ubuntu 24.04+ 上 AppImage 打不开,换 .deb 包安装,里面自带 AppArmor 配置
  • 源码环境报"找不到 pages 目录",基本是 submodule 没拉全,回到仓库根目录重跑npm run setup
  • Wan2GP 不是本地引擎而是远程服务:你得先在 CUDA/ROCm 的 GPU 机器上跑它的 Python 服务,桌面端只发提示词

谁适合用

  • 短视频与电商创作者:文生视频、图生视频多模型 A/B 对比,单条 5-15 秒快速出片
  • 在意隐私的本地推理用户:M 系 Mac 上用 sd.cpp 跑 SD 1.5,图像生成完全不经过外部 API
  • 想改造分发的人:MIT 协议,packages/studio 是独立组件库,UI 和模型网关都能换

如果你只是偶尔出几张图,官方托管的 Web 版免费用就够了,不用装任何东西。

更多细节见仓库内的 README.md。把三步上手的命令从头跑一遍,10 分钟内你就能拿到第一段 AI 视频。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/9 18:18:28

储能参与现货-调频市场的双层交易决策与Matlab实现

储能参与现货电能量-调频辅助服务市场的双层交易决策研究(Matlab代码实现)最近在复盘储能参与电力市场的项目,发现不少同学一上来就盯住“现货价差套利”不放,却忽略了调频辅助服务这条同样重要的收益路径。现在很多省份已经允许储能同时参与现货电能量市…

作者头像 李华
网站建设 2026/9/9 18:17:36

Android投屏Demo实战:MediaProjection与MediaCodec编码传输全解

简介:Android端投屏demo是一份面向Android开发者的示例工程,其核心是演示基于MediaProjection API的手机屏幕镜像到电视、电脑或投影仪等设备的完整流程。压缩包大小33.55MB,共2000个文件,以class、png、xml、json、jar、java等为…

作者头像 李华
网站建设 2026/9/9 18:16:54

Gemini 模型 JSON 输出截断排障指南:参数、协议、架构三层修复

Gemini 模型 JSON 输出截断排障指南:参数、协议、架构三层修复 【免费下载链接】generative-ai Sample code and notebooks for Generative AI on Google Cloud, with Gemini Enterprise Agent Platform 项目地址: https://gitcode.com/GitHub_Trending/ge/genera…

作者头像 李华
网站建设 2026/9/9 18:15:43

diagram-design:前端图表的工程化实践指南

1. “diagram-design”不是工具名,而是一类工程实践的统称 很多人第一次看到“diagram-design”这个词,下意识以为是个新出的软件、插件或 npm 包——比如像 create-react-app 那样带连字符的 CLI 工具。但其实它根本不是某个具体产品,而是…

作者头像 李华
网站建设 2026/9/9 18:15:41

Vue后台分类管理模块实战:从树形数据到递归组件

后台管理系统里最绕不开的一个功能,就是“分类管理”。哪怕是做个最简单的博客后台,也要管文章栏目;做电商后台,商品类目就是命根子;做知识库、文件库、素材库,同样离不开多级分类。这几年我用 Vue 做过很多…

作者头像 李华