Pixelle-Video AI视频生成:输入一个主题,3分钟拿到带配音的短视频
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
午休时想产出一条 30 秒的科普短视频,你不用再打开剪辑软件:在 Pixelle-Video 里输入主题,它自动写文案、生成 AI 配图、合成语音并配上背景音乐,直接出成片。这套 AI 视频生成引擎能让你从安装到第一次出片控制在半小时内。
它是什么
Pixelle-Video 是一个 AI 全自动短视频引擎:你输入一个主题,它按「文案生成 → 配图规划 → 逐帧处理 → 视频合成」四步跑完,输出一条约 2-5 分钟生成时长的带配音成片。技术栈是 Python + Streamlit Web 界面,配图和语音基于 ComfyUI 工作流,也可直连 DashScope、OpenAI、Kling 等模型 API,不一定需要本地显卡。
- 全自动流水线:输入主题即可出片,不需要剪辑经验
- 多模型可选:LLM 支持通义千问、GPT-4o、DeepSeek、Ollama
- 31 个 HTML 模板:覆盖 1080x1920 竖屏、1920x1080 横屏、1080x1080 方形三种尺寸
- ComfyUI 架构:生图、TTS、视频生成工作流可各自独立替换
跑起来
Linux / macOS:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video brew install ffmpeg # macOS;Ubuntu/Debian 用 sudo apt install ffmpeg uv run streamlit run web/app.pyWindows:可以用项目在 Releases 页面发布的 Windows 一键整合包(解压后双击start.bat,无需装 Python 和 ffmpeg),也可以直接从源码启动:
uv run streamlit run web/app.py # 启动后浏览器自动打开 http://localhost:8501启动后你会看到三栏界面:左侧内容输入、中间语音与视觉设置、右侧生成按钮和视频预览区。
配置 AI 服务:把 config.example.yaml 复制为项目根目录的config.yaml,填入你的密钥:
llm: api_key: "your-api-key" # 你的API密钥 base_url: "https://dashscope.aliyuncs.com/compatible-mode/v1" # 方案A: 通义千问(云端) model: "qwen-max" # 方案A: 模型名 # 方案B: 本地Ollama(免费),把上面两行改为: # base_url: "http://localhost:11434/v1" model: "llama3.2" # 配图/视频:云端填 comfyui.runninghub_api_key;本地则启动 ComfyUI保存后回到 Web 界面展开「系统配置」面板,点「保存配置」即可。
第一次出片:从主题到 AI 短视频
输入主题:在左侧「内容输入」选择「AI 生成内容」模式,在文本框里输入主题,分镜数量默认 5 个,可改小加快出片速度。
选参数:中间栏 TTS 工作流保持默认 Edge-TTS 即可,图像工作流用默认,视频模板选竖屏1080x1920/image_default.html。
触发生成:点右侧「生成视频」按钮,进度条会依次显示「生成文案 → 生成配图(按分镜)→ 合成语音 → 合成视频」。
等待完成:5 分镜的视频通常需要 2-5 分钟,取决于 LLM 响应速度和图像生成速度。
查看结果:完成后右侧自动播放视频,并显示时长、文件大小、分镜数;成片保存在output/文件夹。
直接复制这三个主题词试试:
- 科普类:光合作用的过程与意义
- 产品类:智能手表的十大实用功能
- 生活类:保持积极心态的五个实用方法
能力拆解:AI 视频生成的三个进阶玩法
自定义 ComfyUI 工作流
想把配图风格从默认 Flux 换成其他模型,或者 TTS 换成 Index-TTS 时用到。
- 把 ComfyUI 导出的工作流 JSON 放进 workflows/ 目录(selfhost 和 runninghub 两个子目录各存 8 个和 21 个现成示例)
- 在 Web 界面「图像生成」或「TTS 工作流」下拉菜单中选择它
- 点「预览风格」或「预览语音」先测试效果
配图、语音、视频生成三条链路互不干扰,换工作流不用动主流程。
批量 AI 短视频生成
要一次产出一个系列视频时,不用反复点生成。
- 左侧开启「批量生成模式」,批量主题框里每行输入一个主题,最多 100 个
- 统一设置模板、TTS 工作流和 BGM(BGM 可把 MP3 放进
bgm/文件夹自定义) - 点「批量生成」,生成期间保持页面打开
全部成片自动存入历史记录,可在历史页面逐个回放。
切换模板与克隆声音
同一主题想换气质,或想用自己的声音出片。
- 中间栏按尺寸分组选模板:竖屏 25 个、横屏 5 个、方形 1 个,都在 templates/ 目录
- 上传 MP3/WAV 参考音频,用 Index-TTS 工作流做声音克隆
- 点「预览语音」确认音色后再正式生成
按场景配方案
| 场景 | 推荐模板/风格 | 关键参数 | 主题示例 |
|---|---|---|---|
| 科普教育 | image_book.html(文艺书籍风) | 默认 5 分镜、Edge-TTS、1024x1024 | 光合作用的过程与意义 |
| 产品营销 | image_modern.html(潮流现代风) | 1080x1920 竖屏、英文提示词前缀强化风格 | 智能手表的十大实用功能 |
| 个人 Vlog | image_healing.html(治愈水墨风) | 上传参考音频克隆自己的声音 | 旅行中发现的小确幸 |
| 儿童内容 | image_cartoon.html(卡通风) | 提示词前缀加明亮色彩描述 | 为什么月亮会变化 |
科普类主题尽量具体到知识点(说"黑洞的形成原理"而不是"宇宙"),营销类则在主题里直接带上卖点关键词,AI 写稿时会围绕它展开。
排障
进度卡在「生成配图」不动:
- 到「系统配置」确认 RunningHub API Key 已填,或本地 ComfyUI 已启动且 URL 正确(默认
http://127.0.0.1:8188) - 检查工作流 JSON 文件是否还在 workflows/ 里
- 到 ComfyUI 里手动跑一遍同一工作流验证模型已下载
日志看项目根目录的api_server.log。
点「生成视频」立刻报 LLM 错误:
- 核对
config.yaml里 llm 的 api_key、base_url、model 三个字段 - 检查账户余额和网络连通性
- 换本地 Ollama 方案试一次,排除云端 API 问题
配置文件就是根目录的config.yaml,改完重启界面生效。
成片没有配音或语音截断:
- 确认 TTS 工作流选的是
selfhost/tts_edge.json这类可用工作流 - 若用了声音克隆,检查参考音频是否为 MP3/WAV 格式
- 先点「预览语音」单独测 TTS,再跑完整生成
收尾
这套流程适合"给我一个主题就能稳定出片"的场景:日更科普号、产品推广素材、个人分享类短视频。如果你需要逐帧精修或严格的多机位调度,还是传统剪辑软件更合适。今天就能做的事:装好依赖、填一个 LLM 的 API Key,输入"为什么要养成阅读习惯",拿到你的第一条 5 分镜成片。
更多资源:config.example.yaml | docs/zh/ | workflows/
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考