news 2026/9/30 2:06:49

Pixelle-Video|AI 短视频自动生成:如何 5 分钟出一条带解说的视频

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Pixelle-Video|AI 短视频自动生成:如何 5 分钟出一条带解说的视频

Pixelle-Video|AI 短视频自动生成:如何 5 分钟出一条带解说的视频

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

周五下午三点,周一的评审会需要一段一分钟的产品介绍视频。按传统流程写文案、找素材、逐帧剪辑,至少忙一整天;用 Pixelle-Video 输入主题后,AI 短视频自动生成会接手后续环节,几分钟后就能得到一条带解说和背景音乐的视频。

Pixelle-Video 是一个开源的 AI 全自动短视频生成引擎(Apache 2.0):输入一个主题,它依次完成 LLM 写文案、AI 生成配图、语音合成和视频合成,直接产出可发布的 mp4,全程在 Web 界面操作。

🚀 从零到第一个视频产出

前置需要准备两个工具:Python 包管理器 uv 和视频处理工具 ffmpeg(macOS 用 brew install ffmpeg,Ubuntu 用 apt install ffmpeg,Windows 从官网下载后把 bin 目录加入 PATH)。然后克隆并启动:

git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py

uv 会自动安装项目依赖,浏览器随启动打开 http://localhost:8501;Windows 用户也可以改用官方整合包,解压后运行 start.bat,无需装 Python 和 ffmpeg。首次使用要在页面上展开「系统配置」面板填三处:① LLM 配置,下拉选预设模型(如通义千问)并填 API Key,用于写文案;② 图像/视频生成,二选一:云端 RunningHub(只填 Key)或本地 ComfyUI(填服务地址);③ 语音合成默认 Edge-TTS,免费免配置。习惯改文件的话,把 config.example.yaml 复制为 config.yaml,填的是同样三项。

随后在左侧内容输入区输入主题(例如"如何养成阅读习惯"),中间选一个视频模板,点右侧「生成视频」。进度条按"生成文案 → 配图 → 合成语音 → 合成视频"推进,会显示"分镜 3/5 - 生成插图"这类提示;完成后视频自动播放,成品存放在 output/ 目录。

🧩 拆一个机制:主题如何变成分镜视频

项目的核心是 standard.py 里的线性流水线,一条主题串走完三段链路:

  • 输入:一段主题字符串,如"如何养成阅读习惯"。
  • 处理:LLM 先写出标题,再把解说词切成 5 个分镜(每镜默认 5-20 字),并为每个分镜生成一条英文图像提示词。随后逐分镜执行三件事:TTS 合成音频、生成配图(可选 Flux、Qwen、SDXL 等工作流)、把文字、图片和音频填进 HTML 模板渲染成一个视频片段。
  • 输出:所有片段拼接、混入 BGM,得到 output/ 下的完整视频。

这套设计的实用之处在于每一环都能单独换:换 LLM 文案风格就变,换图像工作流配图风格就变,不需要动流水线代码。模板命名有约定,static_ 前缀是纯文字静态模板,image_ 需要 AI 配图,video_ 需要 AI 视频生成,选模板时按前缀判断成本。

📌 三个可直接上手的场景

竖屏知识科普:1080x1920 模板怎么选

  • 要达成什么:一条一分钟的竖屏科普视频,适合抖音、视频号,每段解说配一张插图。
  • 怎么配:内容输入区选「AI 生成内容」模式并输入主题;模板选 1080x1920 分组的 image_default.html(也是默认值);TTS 保持 Edge-TTS;BGM 选内置的 default.mp3。
  • 注意什么:每镜解说默认 5-20 字,5 个分镜约 30 秒;想更长时间话就调大分镜数,但生成耗时会成比例增加。

横屏讲解:1920x1080 电影感模板怎么用

  • 要达成什么:B 站或公众号用的横屏讲解视频,用 image_film 模板的"海报居中 + 上方标题 + 下方解说"版式。
  • 怎么配:模板下拉选 1920x1080 分组的 image_film.html;插图工作流可用 RunningHub 云端或本地 ComfyUI;用英文提示词前缀统一插图风格,可点「预览风格」先试图。
  • 注意什么:图像生成默认 1024x1024,不同模型对尺寸限制不同,出横屏画面前需要把宽度、高度按模板调整。

方形图文帖:static 静态模板怎么省成本

  • 要达成什么:小红书等平台的 1080x1080 方形内容,用于账号定位、品牌展示。
  • 怎么配:模板选 1080x1080 分组的 image_minimal_framed.html;如果内容以纯文字为主,改用 static_ 开头的静态模板,完全不消耗 AI 配图调用。
  • 注意什么:看清模板前缀——static_ 不生成任何媒体,image_ 走图像工作流,video_ 还需要视频生成 API 配置,否则生成会卡在对应步骤。

📋 关键参数速查

以下字段均按 config.example.yaml 中的命名,挑最影响体验的 5 项:

配置项默认值推荐值影响
llm.model / api_key空通义千问等预设 + API Key决定文案质量;用本地 Ollama 可 0 成本运行
comfyui.image.default_workflowrunninghub/image_flux.json云端用 runninghub,本地用 selfhost决定配图生成路线,云端需 RunningHub Key
comfyui.tts.default_workflowselfhost/tts_edge.json保持不变Edge-TTS 免费;Index-TTS 支持声音克隆但依赖 ComfyUI
template.default_template1080x1920/image_default.html按发布平台尺寸选决定视频画幅与版式
comfyui.runninghub_concurrent_limit1普通会员保持 1,上限 10云端工作流并发数,影响批量生成速度

🔍 优点与限制

最扎实的一点是文案、配图、解说、合成四段能力都可替换:ComfyUI、RunningHub、直连 API 三种供应商路线能自由组合,还有完全免费的本地方案。限制在于画面质量受制于所选图像/视频模型,默认 Flux 插画是简笔画风格,表现写实内容时上限不高。适合需要批量产出解说类短视频的人,不适合追求动态运镜和复杂剪辑效果的内容。

📚 资源索引

  • 项目说明与更新日志:README.md
  • 完整配置示例:config.example.yaml
  • 模板与工作流目录:templates/ | workflows/
  • 常见问题排查:docs/zh/troubleshooting.md

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/30 2:01:41

BepInEx完整指南:零改动免费给Unity游戏装上Mod插件的框架

BepInEx完整指南:零改动免费给Unity游戏装上Mod插件的框架 【免费下载链接】BepInEx Unity / XNA game patcher and plugin framework 项目地址: https://gitcode.com/GitHub_Trending/be/BepInEx BepInEx 是一个免费的 Unity 游戏插件框架:把插件…

作者头像 李华