Pixelle-Video AI视频生成指南:一句话主题生成3分钟完整短视频
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
Pixelle-Video 是一个 AI 视频生成工具:输入一个主题,它自动完成文案撰写、AI 配图、语音合成与视频合成,直接产出可发布的成品视频。
🎯 项目定位:AI 全自动短视频生成引擎
Pixelle-Video 把视频制作拆成了一条全自动流水线,用户不需要写脚本、找图、录音或剪辑。
适合的人群与场景:
- 自媒体运营:批量产出抖音、快手、小红书等平台的内容
- 教育讲解:把知识点快速转成带解说词的图文视频
- 企业营销:产品卖点介绍、活动宣传短片
- 零基础用户:全程在 Web 界面点选完成,无剪辑经验要求
能力速览:
| 能力 | 说明 |
|---|---|
| AI 文案 | 按主题创作解说词并切分分镜,默认 5 个 |
| AI 画面 | 每个分镜生成 AI 插图,可选动态视频片段 |
| 语音合成 | Edge-TTS、Index-TTS 等多种引擎,支持声音克隆 |
| 背景音乐 | 可选内置音乐或自定义音频文件 |
| 视频尺寸 | 1080x1920 竖屏、1920x1080 横屏、1080x1080 方形 |
🔄 生成流程拆解:从主题到成片的四个环节
整个流程分四个串联环节,界面上会实时显示进度,例如"分镜 3/5 - 生成插图":
- 文案生成:LLM 根据主题写出解说词,按分镜切段
- 画面规划:每个分镜生成一张配图,选用视频模板时还会生成动态片段
- 语音合成:TTS 引擎把解说词转成配音,上传参考音频可克隆音色
- 视频合成:画面、配音与 BGM 按模板排版,合成最终文件
一个 5 分镜的视频通常需要 2-5 分钟,成品自动保存到output/目录,并在界面内直接预览播放。
🚀 上手实操:从安装到产出第一个视频
环境准备与启动
两种安装路径任选其一:
- Windows:下载一键整合包,解压后双击
start.bat,已内置 Python 与 ffmpeg - macOS/Linux:准备 Python 3.10+,安装包管理器
uv和视频工具ffmpeg,从源码启动
源码启动只需执行一次以下命令:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开 http://localhost:8501,界面为三栏布局:左侧内容输入、中间语音与视觉设置、右侧生成与预览。
填写配置并生成
- 展开「⚙️ 系统配置」:选择 LLM 预设(如通义千问)并填入 API Key;图像服务二选一,填本地 ComfyUI 地址或 RunningHub 的 API Key
- 左侧「内容输入」选「AI 生成内容」,输入主题,如"如何提高工作效率";分镜数保持默认 5
- 中间栏保持默认:TTS 选 Edge-TTS,图像工作流用默认,按目标平台挑一个视频模板
- 点右侧「生成视频」,进度走完即可在预览区查看成片
已有完整文案时,可切换「固定文案内容」模式,跳过 AI 写稿环节直接生成。
⚙️ 模型、语音与模板选型对照表
四个环节的能力都可以替换,按场景选择:
| 组件 | 选项 A | 选项 B | 选择建议 |
|---|---|---|---|
| LLM | 通义千问 / DeepSeek | GPT-4o / Ollama | 云端模型省事,Ollama 本地运行免费 |
| 图像 | ComfyUI 本地,默认 127.0.0.1:8188 | RunningHub 云端,或直连 DashScope、OpenAI、Seedream、Kling 等 API | 有显卡选本地,无显卡选云端 |
| TTS | Edge-TTS | Index-TTS | 标准解说选前者,个人音色选后者 |
| 模板 | static_* 前缀:纯文字,无需 AI 媒体 | image_* / video_* 前缀:AI 图片或视频背景 | 纯文字内容出片最快 |
两个容易忽略的设置项:
- 提示词前缀:控制配图整体风格,须用英文书写,填写后可点「预览风格」测试
- 图像尺寸:默认 1024x1024,不同模型对尺寸的限制不同
模板按尺寸分组显示,命名前缀对应"无媒体、图片背景、视频背景"三种类型,全部模板效果图见 docs/zh/user-guide/templates.md。
💰 部署方案与成本测算
| 方案 | 组合 | 成本量级 |
|---|---|---|
| 完全免费 | Ollama 本地 LLM + ComfyUI 本地生图 | 0 元,需 NVIDIA 显卡(建议 6GB+ 显存) |
| 低成本 | 通义千问 + ComfyUI 本地 | 生成一个 3 分镜视频约 0.01-0.05 元 |
| 纯云端 | OpenAI 等云端 LLM + RunningHub 生图 | 费用较高,但无需本地 GPU 环境 |
自定义 BGM 无额外成本:把 MP3/WAV 文件放进bgm/目录即可在生成时选用。
⚠️ 使用注意与边界
- 不适用场景:多角色对话剪辑、素材混剪、特效动画等复杂剪辑需求暂不支持,成片为单模板风格
- 首次使用必须先完成系统配置,缺 API Key 无法生成;ComfyUI 连接失败时先确认服务在运行、端口 8188 无误
- 生成速度慢时:减少分镜数量、改回本地 ComfyUI、换响应更快的 LLM
- 风格不满意按顺序排查:换 LLM 改文案风格,改提示词前缀换配图风格,换 TTS 工作流换配音,换模板改版式
- 声音克隆仅对支持该能力的工作流生效(如 Index-TTS),参考音频支持 MP3/WAV/FLAC
- 直连 API 的视频模型可能触发内容审核,系统会用中性化提示词自动重试,仍失败时需自行调整主题表述
🧩 进阶能力:API 调用与自定义模板
- API 集成:
pixelle_video/service.py中的PixelleVideoCore可直接在 Python 里调用,适合把视频生成接入自动化内容流水线 - 自定义模板:模板为 HTML+CSS 文件,在
templates/下按尺寸目录新增即可,界面自动识别 - 扩展工作流:数字人口播、图生视频、动作迁移、自定义素材分析等模块也在持续更新中
关键资源:快速上手文档 docs/zh/getting-started/quick-start.md,核心服务源码 pixelle_video/services/。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考