news 2026/9/4 12:11:24

Open Generative AI:免费的本地开源 AI 图像视频生成工作室

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Open Generative AI:免费的本地开源 AI 图像视频生成工作室

Open Generative AI:免费的本地开源 AI 图像视频生成工作室

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

Open Generative AI 是一个免费的开源 AI 创作工作室,接入 400+ 图像、视频模型,主打无内容过滤和自托管,适合想要专业 AI 生成又在意成本与隐私的个人用户。

  • 免费开源,无订阅费
  • 无内容过滤和提示词限制
  • 支持本地推理,数据不出设备
  • 400+ 模型,覆盖图像与视频

🚀 怎么跑起来

零安装直接玩:打开它的在线托管版,注册一个免费账户就能在浏览器里使用全部工作室,不需要装 Node.js 也不用配环境,托管版会始终跟进最新模型。

本地私有化跑:下载对应平台的桌面应用(macOS 的 DMG、Windows 的 EXE、Linux 的 AppImage 或 DEB),装完即用;如果你是开发者想深度定制,也可以克隆仓库 https://link.gitcode.com/i/c4972376ec1b5f6b1a14d62a7327a528 后安装依赖启动开发模式。本地推理只在桌面应用里可用,托管版固定走云端 API。

硬件门槛大概分三档:

档位配置能跑什么
基础8GB 内存SD 1.5 图像生成,建议 512×512 分辨率
中等16GB 内存流畅跑 SDXL 和部分视频模型
高端16GB+ 内存和独立 GPU全部模型、4K 输出

启动阶段的系统警告基本都是签名问题:macOS 首次运行会被 Gatekeeper 拦截,在"系统设置 → 隐私与安全性"里点"仍要打开"即可;Windows 的 SmartScreen 警告点"更多信息 → 仍要运行";Linux 用 AppImage 若起不来,装一下libfuse2或改用 .deb 包就能解决。

🎨 能生成什么

图像:输入文字描述,输出成品图(50+ 文生图模型);上传一张参考图,输出按图改图的结果(55+ 图生图模型),风格转换、重绘都在这一个工作室里完成,模式会根据你是否上传参考图自动切换。

视频:输入文字,输出短视频(40+ 文生视频模型);输入一张起始帧图像,输出让画面动起来的视频(60+ 图生视频模型),适合给产品图加动态效果。

声音与口型:输入肖像图片加音频,输出会说话的人物视频;输入现有视频加音频,输出口型对齐的配音视频。Lip Sync 工作室提供 9 个专用模型,两种模式覆盖虚拟主播、外语片配音等需求。

镜头语言:输入相机类型、镜头、焦距和光圈参数,输出带专业电影质感的提示词修饰,Cinema Studio 内置多组预置镜头效果,把"电影感"变成可选择的参数。

⚙️ 本地推理怎么选

两个引擎定位不同:sd.cpp是应用内置的 C++ 引擎,在本机跑图像模型,支持 CPU、Apple Silicon 的 Metal 以及 Linux/Windows 的 CUDA/Vulkan/ROCm;Wan2GP是连接你自己部署的服务端(需要 CUDA/ROCm GPU),负责视频模型和大型图像模型,桌面端本身可以跑在任意设备上,两者都在"设置 → 本地模型"里配置。

用途推荐模型一句话理由
快速概念草图Dreamshaper 8轻量出图快,适合快速迭代
高质量成品图Flux Dev高分辨率,细节丰富
商业级图像Seedream 5.0支持 4K 和多种宽高比
短视频内容LTX Video速度最快的视频选项
创意短视频Wan 2.2质量与速度平衡好
影视级画面Hunyuan Video文生视频质量极高

✍️ 提示词怎么写效果更好

  • 写具体场景:把环境、光线、氛围写进描述里,模型能抓到更多画面细节。
  • 加风格关键词:注明油画、赛博朋克这类风格和氛围词,输出风格更贴合预期。
  • 用负面提示:明确排除不想要的元素,减少无效元素出现的概率。
  • 按模型调参数:根据模型特性调整步数和分辨率,兼顾速度与效果。

部分编辑类模型支持一次喂入最多 14 张参考图,按你选择的顺序发送;工作流工作室则能把多个生成步骤串成自动化流水线,支持保存和复用模板。

🎯 适合谁

  • 社媒内容创作者 → 快速产出短视频与配图
  • 设计师 → 产品与角色的快速概念设计
  • 本地化团队 → 为外语视频配音对口型
  • 开发者 → 基于 MIT 协议二开自有平台

🧱 技术底座

技术栈一行带过:Next.js 14 + React 18、Tailwind CSS v3、npm workspaces 模块化组织代码,模型目录(见 src/lib/models.js)是 400+ 模型定义的唯一来源,通过 Muapi.ai 统一接口调用。项目采用 MIT 许可证,可自由修改、分发和商业使用。

它把订阅制平台的常见限制拆掉了:免费开源、数据留在本地、模型池足够大。想先试水就用托管版,在意隐私就上桌面端本地推理,代码在 README.md 里都有说明,直接取用即可。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/4 12:11:20

从零实现猫狗分类CNN:Python+TensorFlow完整项目实战与调优

简介:本资源是一套完整可运行的猫狗图像分类实战项目,面向计算机及相关专业本科生开展毕业设计、课程设计或期末大作业的学生,也适用于深度学习入门者进行CNN原理与工程实践结合的系统训练。项目基于Python与TensorFlow/Keras构建卷积神经网络…

作者头像 李华
网站建设 2026/9/4 12:10:02

一张图变成3D环绕视频:Stability AI SV3D 新手速通指南

一张图变成3D环绕视频:Stability AI SV3D 新手速通指南 【免费下载链接】generative-models Generative Models by Stability AI 项目地址: https://gitcode.com/GitHub_Trending/ge/generative-models 本文带你上手 Stability AI 官方生成模型仓库&#xff…

作者头像 李华
网站建设 2026/9/4 12:09:40

基于多模态大模型与向量数据库构建个人智能记忆搜索引擎

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/4 12:08:17

栈溢出导致程序崩溃:大数组为何不能放在函数内?

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华