news 2026/9/4 11:34:06

Pixelle-Video 免费AI短视频生成引擎上手指南

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Pixelle-Video 免费AI短视频生成引擎上手指南

Pixelle-Video 免费AI短视频生成引擎上手指南

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

每天要更短视频、但脚本、找图、配音、剪辑加起来要花大半天,这是很多内容运营最熟悉的处境。Pixelle-Video 是开源的 AI 全自动短视频引擎:输入一个主题,它负责写文案、生成配图、合成配音和背景音乐,再拼成一条完整视频,全程约 5 分钟,一个剪辑动作都不用做。

最短路径:4 步跑通第一条视频

  1. 克隆仓库:git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
  2. 进入项目目录,运行uv run streamlit run web/app.py,浏览器自动打开 localhost:8501
  3. 展开「⚙️ 系统配置」,选一个 LLM 预设(比如通义千问)填入 API Key,保存
  4. 输入主题,点「🎬 生成视频」

5 分镜的视频大约 2-5 分钟出炉,成片自动存在 output/ 目录里。

能力全景:从一句主题到成片

一句话主题变成 60 秒成片

场景:你只有一个选题,没有脚本。系统把「为什么要养成阅读习惯」这样的主题自动拆成 5 个带画面感的分镜,每句解说对应一帧画面,进度条依次走过「生成文案 → 生成配图 → 合成语音 → 合成视频」。LLM 入口在系统配置面板,预设里选通义千问、OpenAI、DeepSeek 或本地 Ollama;稿子已经写好的话,切到「固定文案内容」模式直接粘贴。

全片画风统一靠模板加提示词前缀

场景:每张 AI 插图各自为政,画风漂移。其实每张图生成后都会套进一个 HTML 模板排版,templates/ 目录按 1080x1920 竖屏、1920x1080 横屏、1080x1080 方形分类了 30 多套;再用 image.prompt_prefix 填一段风格描述,比如极简黑白火柴人线条插画,每次生图前都会自动拼上,整条片就像同一个设计师出的。

声音和配乐一次配齐

场景:解说声音像念课文,BGM 还要另外找。内置免费的 Edge-TTS 中文音色可以直接用;Index-TTS 支持上传一段参考音频做声音克隆,克隆出来的就是你自己的声线。把音乐文件放进 bgm/ 目录,界面里就能直接选用当背景乐。

批量任务加扩展流水线

场景:一周 5 更扛不住。批量模式一次输入多个主题,历史记录页管理所有任务,跑完一晚上 20 条不是问题。扩展工作流还有数字人口播、图生视频、动作迁移,全部由 workflows/ 下的 JSON 工作流驱动,ComfyUI 本地和 RunningHub 云端可以随需求混搭。

实战工作流:一个内容号运营者的一天

输入:晚上 9 点,你先把 LLM、图像工作流、模板、语音都配置好并保存。然后在批量模式里把今晚要做的 5 个选题一次性输进去,一行一个,模板固定选 1080x1920 的 image_modern.html,再上传一段 30 秒真人录音,让 Index-TTS 克隆出你自己的音色。

等待:点生成。5 条视频大约需要 10-25 分钟,云端方案下单条成本约 1-5 分钱,这段时间去洗漱正好。

检查产出:醒来在输出预览播放器里逐条过一遍,画面风格是否统一、声音像不像自己;要发的文件在 output/ 目录直接取。整个过程里你只做了一次配置和一次检查,其余全是机器在干活。

新手最常踩的 3 个坑

坑一:LLM 一直报错。症状:文案阶段反复失败。原因:只填了 api_key,忘了 base_url。修复:复制 config.example.yaml 为 config.yaml,把 base_url 一并补全再保存。

坑二:卡在「生成配图」。症状:进度条永远停在配图这一步。原因:工作流前缀和凭证不匹配,runninghub/ 前缀的要填 RunningHub API Key,selfhost/ 前缀的要能连上本地 ComfyUI。修复:按 workflows/ 目录里的前缀对齐你的部署方式,别混用。

坑三:配图风格漂移。症状:同一个主题的两张插图画风不一致。原因:生图提示词里没有固定风格描述。修复:填上 image.prompt_prefix,比如一句英文的黑白火柴人线条风格描述,全片画风就锁死了。

配置方案上:本地显卡配 Ollama 加 ComfyUI 完全免费;没有显卡就用通义千问加 RunningHub 云端,每条 1-5 分钱;追求画质可直连 DashScope、OpenAI 的媒体模型,按量付费。

资源索引:需要时去哪找

  • docs/zh/:安装、配置、快速开始、声音克隆等完整教程,报错先翻 FAQ
  • templates/:模板库,改 CSS 就能定制自己的品牌风格
  • workflows/:runninghub 与 selfhost 两套 JSON 工作流,配置图像、视频、TTS 时在这里切换
  • pixelle_video/tts_voices.py:全部支持音色的清单,配解说前先来挑

现在就动手

git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video,然后uv run streamlit run web/app.py,丢一个主题进去,等咖啡凉透,你的第一条 AI 短视频就该出锅了。

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/4 11:32:00

从直流到伺服:电机控制原理、驱动电路与STM32实战全解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/4 11:29:55

基于离线数据的股票量化回测系统构建指南:从数据获取到模拟交易

简介:这是一套面向编程初学者与金融兴趣者的模拟炒股软件开发学习资源,聚焦股票交易逻辑实现与离线数据分析实践,帮助用户理解K线图展示、买卖模拟、技术指标计算等核心功能。压缩包共82个文件,以55个ASP服务端脚本为主干&#xf…

作者头像 李华
网站建设 2026/9/4 11:29:44

谷歌 Gemini 3.8 双模型发布,AI 自动修漏洞走向实战

美东时间 9 月 2 日,谷歌发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber 两款模型:前者是面向开发者的新一代低价位模型,后者专攻漏洞发现和自动打补丁,只对审核通过的"可信防御者"开放。按谷歌官方博客的说法&#…

作者头像 李华
网站建设 2026/9/4 11:24:08

AI Agent技能开发实战:基于Claude Code的营销自动化框架解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/4 11:23:58

微信聊天记录导出教程:4 条命令把微信记录变成 3 种文件格式

微信聊天记录导出教程:4 条命令把微信记录变成 3 种文件格式 【免费下载链接】WeChatMsg 提取微信聊天记录,将其导出成HTML、Word、CSV文档永久保存,对聊天记录进行分析生成年度聊天报告 项目地址: https://gitcode.com/GitHub_Trending/we…

作者头像 李华