5分钟上手Pixelle-Video:AI短视频自动生成完整教程
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
做短视频最劝退的环节不是拍素材,而是把文案、配图、配音、剪辑一条条串起来。Pixelle-Video 是一个 AI 全自动短视频引擎,你只需输入一个主题,它就能自动完成文案撰写、AI 配图、语音合成、背景音乐添加和最终视频合成的全流程,整个过程不需要任何剪辑经验。
价值速览:人工做视频 vs Pixelle-Video
| 制作环节 | 传统人工方式 | 使用 Pixelle-Video |
|---|---|---|
| 脚本撰写 | 自己选题、写稿、反复修改 | 输入主题,LLM 自动创作解说词 |
| 配图素材 | 图库找图或逐张 AI 绘画 | 按分镜自动匹配生成 AI 插图 |
| 配音录制 | 自己录音、多录多遍 | 选一个 TTS 工作流一键合成 |
| 剪辑合成 | 手动剪片、加字幕、调节奏 | 按分镜顺序自动合成成片 |
| 单条耗时 | 数小时起步 | 通常几分钟内完成 |
| 硬件门槛 | 录音设备 + 剪辑软件 | 一台电脑 + 浏览器 |
差异的核心在于:传统流程里每个环节都是手工活,而 Pixelle-Video 把它拆成了"文案生成 → 配图规划 → 逐帧处理 → 视频合成"的流水线,每个环节都可以单独换模型、换模板,不满意哪一段就只重做哪一段。
5分钟上手:三步跑通第一个视频
第一步:环境准备
Windows 用户可直接下载官方整合包,解压后双击start.bat,无需安装 Python 和 ffmpeg。其他系统从源码启动,先装好uv和ffmpeg,然后:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。
第二步:关键配置
展开页面里的「系统配置」面板,只做两件事:一是 LLM 配置,下拉选择预设模型(通义千问、GPT-4o、DeepSeek、Ollama)并填入 API Key,文案由它生成;二是媒体生成配置,三选一——本地 ComfyUI 填地址、RunningHub 填 API Key、或直连 DashScope/OpenAI/Kling 等模型的 API Key。填完点击「保存配置」即可,参考模板在 config.example.yaml。
第三步:生成第一个视频
左侧选「AI 生成内容」模式,输入主题(例如"为什么要养成阅读习惯"),默认 5 个分镜;中间栏 TTS 选默认的 Edge-TTS 即可,模板选竖屏1080x1920/image_default.html;右侧点「生成视频」,页面会实时显示"分镜 3/5 - 生成插图"这类进度,完成后自动播放,文件保存在output/目录。
功能亮点:四个最值得注意的设计
双模式文案:AI 写稿与固定文案自由切换
没有文案就选「AI 生成内容」,让大模型按主题直接写解说词;文案已经写好就选「固定文案内容」,粘贴全文后还能选按段落、按行或按句子分割,每一段对应一个分镜。适合"稿子是老板写的,我只想要视频"的场景。
多风格模板库:三种画幅开箱即用
templates/目录下按竖屏 1080x1920、横屏 1920x1080、方形 1080x1080 分好组,内置三十多个风格模板:书籍风、治愈系、电影感、霓虹、极简插画等。模板按static_*(纯静态)、image_*(配 AI 图)、video_*(配 AI 视频片段)分类,Web 界面里可以直接预览再选择,会写 HTML 的话还能自己加模板。
原子能力灵活组合:三条通道随意切换
这是它和普通视频脚本生成器的最大区别:图像、视频、TTS、素材分析(VLM)每个环节都支持 ComfyUI 工作流、RunningHub 云端工作流、直连模型 API 三条通道,可以按需混搭。workflows/runninghub/和workflows/selfhost/里放的都是可直接使用的示例工作流,FLUX、SDXL、Qwen 生图,WAN 2.1/2.2 生视频都有现成配置。
声音克隆与扩展流水线
TTS 除了 Edge-TTS 还支持 Index-TTS 等方案,上传一段参考音频就能克隆音色并试听预览,适合做个人 IP 账号。README 里还列了「数字人口播」「图生视频」「动作迁移」「自定义素材」等扩展流水线:上传参考视频和图片做动作迁移,或上传自己的照片视频让 AI 分析后生成脚本。
实战用例:三个典型场景
科普类账号:把复杂概念变成竖屏讲解视频。知识博主想发"为什么我们还没有找到外星文明"。操作点:AI 生成内容模式输入主题;模板选横屏image_film.html适配 B 站和 YouTube;TTS 选音色平稳的解说风格。AI 会把主题拆成分段递进的分镜,每段自动配图。
电商卖家:产品卖点秒变推广片。已有产品文案,不想让 AI 自由发挥。操作点:固定文案模式粘贴卖点文案,选按段落分割;模板选image_modern.html这类现代科技风贴合产品调性;挂一段内置 BGM 增加氛围感。
个人创作者:用自己的照片讲故事。想把手账和旅行照片做成生活感悟视频。操作点:使用「自定义素材」模式上传自己的照片和视频,AI 智能分析素材内容并生成匹配脚本;选治愈风image_healing.html模板;TTS 用克隆音色让成片像本人在讲。
避坑快答
Q:图像生成连接失败,视频卡在第一步?先点配置面板里的「测试连接」确认 ComfyUI 或 RunningHub 服务是否可达;再核对 API Key 和 Base URL 是否填错、网络能否直连。
Q:文案或配图风格不满意怎么调?文案换 LLM 模型重新生成;配图改提示词前缀(英文)整体换风格,或换一个图像工作流;语音和版式再分别调 TTS 工作流和模板。
Q:生成要花多少钱?本地有显卡可以走 Ollama 本地 LLM + 本地 ComfyUI,完全免费;预算有限选通义千问做文案 + 本地 ComfyUI,成本很低。
Q:支持哪些视频尺寸?竖屏 1080x1920(抖音、快手、Reels)、横屏 1920x1080(B 站、YouTube)、方形 1080x1080(Instagram),输出均为 MP4。
Q:想用自己喜欢的背景音乐?把 MP3/WAV 文件放进bgm/文件夹,Web 界面 BGM 选项里选「自定义音乐」,还能点「试听 BGM」先预览。
今天就把项目跑起来,输入你的第一个主题。更多操作细节见官方文档:Web 界面使用指南、配置说明。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考