news 2026/10/2 7:59:00

Pixelle-Video AI视频生成指南:一句话主题生成3分钟完整短视频

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Pixelle-Video AI视频生成指南:一句话主题生成3分钟完整短视频

Pixelle-Video AI视频生成指南:一句话主题生成3分钟完整短视频

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

Pixelle-Video 是一个 AI 视频生成工具:输入一个主题,它自动完成文案撰写、AI 配图、语音合成与视频合成,直接产出可发布的成品视频。

🎯 项目定位:AI 全自动短视频生成引擎

Pixelle-Video 把视频制作拆成了一条全自动流水线,用户不需要写脚本、找图、录音或剪辑。

适合的人群与场景:

  • 自媒体运营:批量产出抖音、快手、小红书等平台的内容
  • 教育讲解:把知识点快速转成带解说词的图文视频
  • 企业营销:产品卖点介绍、活动宣传短片
  • 零基础用户:全程在 Web 界面点选完成,无剪辑经验要求

能力速览:

能力说明
AI 文案按主题创作解说词并切分分镜,默认 5 个
AI 画面每个分镜生成 AI 插图,可选动态视频片段
语音合成Edge-TTS、Index-TTS 等多种引擎,支持声音克隆
背景音乐可选内置音乐或自定义音频文件
视频尺寸1080x1920 竖屏、1920x1080 横屏、1080x1080 方形

🔄 生成流程拆解:从主题到成片的四个环节

整个流程分四个串联环节,界面上会实时显示进度,例如"分镜 3/5 - 生成插图":

  1. 文案生成:LLM 根据主题写出解说词,按分镜切段
  2. 画面规划:每个分镜生成一张配图,选用视频模板时还会生成动态片段
  3. 语音合成:TTS 引擎把解说词转成配音,上传参考音频可克隆音色
  4. 视频合成:画面、配音与 BGM 按模板排版,合成最终文件

一个 5 分镜的视频通常需要 2-5 分钟,成品自动保存到output/目录,并在界面内直接预览播放。

🚀 上手实操:从安装到产出第一个视频

环境准备与启动

两种安装路径任选其一:

  • Windows:下载一键整合包,解压后双击start.bat,已内置 Python 与 ffmpeg
  • macOS/Linux:准备 Python 3.10+,安装包管理器uv和视频工具ffmpeg,从源码启动

源码启动只需执行一次以下命令:

git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py

浏览器会自动打开 http://localhost:8501,界面为三栏布局:左侧内容输入、中间语音与视觉设置、右侧生成与预览。

填写配置并生成

  1. 展开「⚙️ 系统配置」:选择 LLM 预设(如通义千问)并填入 API Key;图像服务二选一,填本地 ComfyUI 地址或 RunningHub 的 API Key
  2. 左侧「内容输入」选「AI 生成内容」,输入主题,如"如何提高工作效率";分镜数保持默认 5
  3. 中间栏保持默认:TTS 选 Edge-TTS,图像工作流用默认,按目标平台挑一个视频模板
  4. 点右侧「生成视频」,进度走完即可在预览区查看成片

已有完整文案时,可切换「固定文案内容」模式,跳过 AI 写稿环节直接生成。

⚙️ 模型、语音与模板选型对照表

四个环节的能力都可以替换,按场景选择:

组件选项 A选项 B选择建议
LLM通义千问 / DeepSeekGPT-4o / Ollama云端模型省事,Ollama 本地运行免费
图像ComfyUI 本地,默认 127.0.0.1:8188RunningHub 云端,或直连 DashScope、OpenAI、Seedream、Kling 等 API有显卡选本地,无显卡选云端
TTSEdge-TTSIndex-TTS标准解说选前者,个人音色选后者
模板static_* 前缀:纯文字,无需 AI 媒体image_* / video_* 前缀:AI 图片或视频背景纯文字内容出片最快

两个容易忽略的设置项:

  • 提示词前缀:控制配图整体风格,须用英文书写,填写后可点「预览风格」测试
  • 图像尺寸:默认 1024x1024,不同模型对尺寸的限制不同

模板按尺寸分组显示,命名前缀对应"无媒体、图片背景、视频背景"三种类型,全部模板效果图见 docs/zh/user-guide/templates.md。

💰 部署方案与成本测算

方案组合成本量级
完全免费Ollama 本地 LLM + ComfyUI 本地生图0 元,需 NVIDIA 显卡(建议 6GB+ 显存)
低成本通义千问 + ComfyUI 本地生成一个 3 分镜视频约 0.01-0.05 元
纯云端OpenAI 等云端 LLM + RunningHub 生图费用较高,但无需本地 GPU 环境

自定义 BGM 无额外成本:把 MP3/WAV 文件放进bgm/目录即可在生成时选用。

⚠️ 使用注意与边界

  • 不适用场景:多角色对话剪辑、素材混剪、特效动画等复杂剪辑需求暂不支持,成片为单模板风格
  • 首次使用必须先完成系统配置,缺 API Key 无法生成;ComfyUI 连接失败时先确认服务在运行、端口 8188 无误
  • 生成速度慢时:减少分镜数量、改回本地 ComfyUI、换响应更快的 LLM
  • 风格不满意按顺序排查:换 LLM 改文案风格,改提示词前缀换配图风格,换 TTS 工作流换配音,换模板改版式
  • 声音克隆仅对支持该能力的工作流生效(如 Index-TTS),参考音频支持 MP3/WAV/FLAC
  • 直连 API 的视频模型可能触发内容审核,系统会用中性化提示词自动重试,仍失败时需自行调整主题表述

🧩 进阶能力:API 调用与自定义模板

  • API 集成:pixelle_video/service.py中的PixelleVideoCore可直接在 Python 里调用,适合把视频生成接入自动化内容流水线
  • 自定义模板:模板为 HTML+CSS 文件,在templates/下按尺寸目录新增即可,界面自动识别
  • 扩展工作流:数字人口播、图生视频、动作迁移、自定义素材分析等模块也在持续更新中

关键资源:快速上手文档 docs/zh/getting-started/quick-start.md,核心服务源码 pixelle_video/services/。

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/2 7:55:33

CSP-J初赛高频考点:int范围、进制转换、格雷码与栈的出栈序列解析

简介:面向参与CSP-J组初赛的考生和信息学竞赛指导教师,这份文档收录了二零二四年CSP-J组初赛的部分试题与答案解析,内容组织紧凑,便于考前快速浏览。主要分为两个模块:一是单选题部分,覆盖三十二位整数存储…

作者头像 李华
网站建设 2026/10/2 7:55:23

OpenCV工业缺陷检测实战:solvePnP姿态估计与intersectConvexConvex几何判断

1. 从一个“抓缺陷”的需求说起1.1 这个实例到底在做什么“抓出三个缺陷”这个标题听起来像是工厂质检线上的活儿,实际上它确实是。这个 OpenCV 实例要解决的问题很具体:在一张工业零件或者产品的图像里,自动找出三个预先定义好的缺陷区域&am…

作者头像 李华
网站建设 2026/10/2 7:53:37

Obsidian+WorkBuddy+Gitee:AI驱动的个人知识库实战方案

这两年我一直在折腾个人知识库这件事,从 Word 文档堆文件夹,到印象笔记,再到 Notion,工具换了不少,核心痛点始终没变:内容越记越多,用的时候根本找不到;就算找到了,碎片和…

作者头像 李华