Pixelle-Video 实操指南:零基础 5 分钟出第一条全自动 AI 短视频
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
一条视频要剪几小时?现在只需一句主题
你是不是也干过这种事:脑子里有个想讲的主题,结果写脚本 1 小时、找配图 2 小时、剪片子再 2 小时,最后那条 1 分钟的视频,花掉你小半个工作日。
现在换 Pixelle-Video:它是开源的 AI 全自动短视频引擎,你只输入一个主题,它自己写文案、配 AI 插图、合成解说和背景音乐,直接吐出一条能发的成品视频。全程你不用碰任何剪辑软件。
最快跑通的路径:四步看到第一条视频
不用啃文档,最短路径就四步:
- 下载 Windows 一键整合包并解压,Python、ffmpeg 等依赖全在里面,装好即用;
- 双击
start_web.bat,浏览器自动打开本地页面; - 在页面里选一个 LLM 预设(比如通义千问),填上你的 API Key,保存;
- 在左侧输入框敲一个主题,比如「为什么猫总盯着墙角看」,点「生成视频」。
没有 Windows 包?源码党一条命令也能跑:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video && uv run streamlit run web/app.py点下按钮后,进度条会依次走过「生成文案 → 生成配图 → 合成语音 → 合成视频」。3-5 个分镜的视频大约 2-5 分钟出炉,成片自动存到output/目录。
它替你省了哪几步
文案:你不用打一个字本来你要对着空白文档憋解说词,现在 LLM 直接把主题拆成带画面感的分镜脚本,每句话对应一帧画面。输入「如何高效管理时间」,出来的就是一份五句带镜头感的口播稿。已有现成稿子?切到「自定义内容」模式直接粘贴,系统不做改写。
配图:每个分镜自动画一张本来你要满世界找素材、抠图排版,现在系统给每个分镜生成一张 AI 插图,再套进 HTML 模板排版。templates/目录按 1080x1920、1920x1080、1080x1080 分了 30 多套模板,从治愈系到霓虹风都有,选「image_neon.html」全片就是赛博感。
配音和 BGM:一键到位解说词直接转语音,内置免费的 Edge-TTS,还有 Index-TTS 这类支持声音克隆的方案。把喜欢的音乐文件丢进bgm/文件夹,界面里就能选,省掉了配乐搜索和音量对齐那两步。
批量和进阶:晚上挂机,早上收片历史记录页可以「复制参数」一键复用配置,批量模式每行填一个主题,一次最多 100 条排队生成。想再进一步,还有数字人口播、图生视频、动作迁移三条流水线可选。
做电商的阿杰:一周的活压进一个晚上
阿杰卖宠物用品,管着 4 个账号。以前一条带货讲解视频,拍、剪、配、发要一整天,一周撑死更 4 条。
现在他的流程是:周五下午把下周 8 个选题按每行一个写进批量模式,模板固定选同一套保持账号风格统一,点「批量生成 8 个视频」,然后合上电脑。第二天早上 8 条视频躺在历史记录页,他逐条检查后直接排期发布。
单条成本几分钱上下(通义千问 + RunningHub 云端配图),原来 8 个工作日的活,现在一个晚上加半小时审稿。他最满意的是「复制参数」:哪条数据好,点一下就把同款配置拉出来做第二条。
三种方案怎么选
| 方案 | 适合谁 | 关键配置 | 大致成本 | 一句话点评 |
|---|---|---|---|---|
| 完全免费 | 有本地显卡 | Ollama 本地 LLM + 本地 ComfyUI | 0 元,电费自理 | 数据不出门,就是部署费点事 |
| 云端经济 | 没显卡、预算紧 | 通义千问 + RunningHub 云端工作流 | 每条约 1-5 分钱 | 性价比之王,新手首选 |
| 专业混合 | 追画质和效率 | GPT + 直连 API 媒体模型 | 按量付费 | 最灵活,配置项也最多 |
新手最容易配错的两处:一是把config.example.yaml复制成config.yaml时只填了 api_key 忘了 base_url,LLM 会一直报错;二是选配图工作流时,带runninghub/前缀的要填 RunningHub 的 API Key,带selfhost/前缀的必须有本地 ComfyUI,混着用就会卡死在「生成配图」这一步。
避坑与进阶:三条真实经验
克隆你的专属音色现象:默认音色播自己的内容,完播率就是差口气。 原因:Index-TTS 支持声音克隆,一段短音频就能当声线样本。 怎么做:选tts_index2.json工作流,上传你的参考音频,视频开口就是「你」的声音。
用提示词前缀锁死画风现象:同一个主题,两张配图风格悄悄漂移。 原因:每次生图是独立请求,没有前缀就各画各的。 怎么做:在config.yaml的 image.prompt_prefix 里写死风格,比如 "Minimalist black-and-white matchstick figure style",全片像同一位设计师画的。
让静态照片动起来现象:老照片、产品图只能配文字,画面干。 原因:默认流水线只生成静态帧。 怎么做:切到图生视频或动作迁移流水线,上传参考视频加一张照片,产品图立刻变成动态展示。
往深了走,翻这几个地方
- docs/zh/:中文文档主目录,安装、配置、快速开始都在里面,装不上环境先来这里
- config.example.yaml:配置清单,每个开关都写了注释,改配置前先看它
- templates/:30 多套 HTML 分镜模板,想换品牌风格直接改 CSS
- pixelle_video/tts_voices.py:全部可用音色清单,配 TTS 前先来这挑
- workflows/runninghub/ 和 workflows/selfhost/:图片、视频、TTS 全套工作流 JSON,懂 ComfyUI 的可以照格式自己加
现在就动手
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video,然后运行uv run streamlit run web/app.py(Windows 用户直接双击start_web.bat)。挑一个你念叨了很久的主题输进去,等你那杯咖啡凉透,第一条视频就该躺在输出区等你发出去了。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考