Open Generative AI 自托管免费 AI 视频生成工作室:400+ 模型覆盖影视制作全流程
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open Generative AI 是开源、可自托管的 AI 视频生成工作室,聚合 Flux、Kling、Sora、Veo 等 400+ 模型,支持文字转视频、图像转视频、镜头控制与唇形同步,适合短视频创作者与影视制作爱好者。
一句话做出带电影感的短片
拿一个具体任务来说:「宁静的山湖日出,16:9,胶片质感」。在 Cinema Studio 里把这句话写进场景描述,再选一个 16mm 胶片风格的相机参数,提交后得到一段带浅景深和暖色调的短片,整个过程不需要离开界面。历史面板会自动记录每次结果,随时可以回看或下载。
选哪条上手路径:浏览器版还是桌面版
只想先体验功能,走浏览器在线版最快:打开官方在线版本,注册免费账号,图像、视频、唇形同步、工作流等工作室全部可用,不需要安装任何东西。
需要本地模型、或希望数据不出内网的,选桌面应用:从 Releases 页下载对应安装器(macOS Intel/Apple Silicon、Windows、Linux 的 AppImage 与 DEB)直接安装,不依赖 Node.js。各平台下载入口与首次启动的处理方式都写在 README.md 里。
功能走查:从素材到成片的四步流水线
先备好分镜与人物立绘
Image Studio 负责素材生产:不带参考图时走文字生图,可用 Flux、Midjourney、Nano Banana 2 等 50+ 模型;上传参考图后自动切到 55+ 图生图模型,兼容模型一次最多接受 14 张参考。上传过的图会存进本地历史,跨会话直接复用,不用反复上传。适合需要批量准备分镜、人物立绘和风格参考的人。
生成第一支视频:纯文字或首帧驱动
Video Studio 沿用同样的切换逻辑:40+ 文字转视频模型(Kling、Sora、Veo、Wan、Seedance、Hailuo、Runway 等)与 60+ 图像转视频模型,把分镜图作为首帧上传后自动改为图生视频。画幅和时长(16:9、9:16、4:3,5/10/15 秒)按各模型能力提供选项,长片内容还能用 Extend 类模型续接;已有长素材时,AI Clipping 可以自动剪出高光片段。适合想快速验证点子、再决定投入精力的短视频创作者。
用相机、镜头和光圈做影视化
Cinema Studio 把真实拍摄参数翻译成优化后的提示词:6 种相机(从经典 16mm 胶片到大画幅 70mm)、11 种镜头、8mm 到 85mm 焦段,以及 f/1.4、f/4、f/11 三档光圈。用法是先写场景,再按想要的观感挑参数,下面这组就是常见的胶片感搭配:
scene: quiet sunrise at a mountain lake camera: Classic 16mm film lens: anamorphic focal: 35mm aperture: f/1.4适合追求电影质感、或需要整套内容保持统一视觉语言的人。
让声音和口型对齐
Lip Sync Studio 提供 9 个模型、两种入口:「人像图 + 音频」把静态人像变成说话视频,「已有视频 + 音频」直接重对齐口型;Audio Studio 则可以顺带生成和编辑音乐。选好模式、上传素材与音频,运动提示词可填可不填,点生成即可;刷新页面后未完成的作业会自动接续。适合配音、多语本地化和数字人内容。
进阶玩法:本地推理、工作流与 API
- 本地推理(仅桌面应用):在设置里的 Local Models 配两台引擎。内置的 sd.cpp 在本机跑 SD 1.5、SDXL、Z-Image 等图像模型,Apple Silicon 走 Metal 加速;Wan2GP 则连到你自建的 GPU 服务器,跑 Flux、Wan 2.2 这类大模型,桌面端只负责发提示词。8GB 内存的机器建议避开 Z-Image,选 2GB 上下的 SD 1.5 模型。
- Workflow Studio:拖拽节点把图像、视频、音频模型接成流水线,可以从预置模板或社区模板起步,保存的流程在 Playground 里直接跑。
- API 集成:底层客户端走「先提交、再轮询」的两步模式,用 x-api-key 请求头鉴权,文件上传接口返回托管 URL 供模型引用,具体实现见 src/lib/muapi.js。
常见坑与处理
- macOS 首次启动被拦截(应用未做公证)→ 对应用执行一次
xattr -cr,或在「隐私与安全性」里点「仍要打开」,之后无需重复。 - Ubuntu 24.04 上桌面应用起不来(AppArmor 限制 Chromium 沙箱)→ 改装 .deb 包(自带对应 profile),或给 AppImage 用户临时关闭
kernel.apparmor_restrict_unprivileged_userns。 - 8GB 内存的基础款 Mac 跑 Z-Image 把系统卡死 → 换约 2GB 的 SD 1.5 模型,或把内存升到 16GB 再上大模型。
完整的安装细节与模型清单见 README.md,架构与状态设计说明在 project_knowledge.md。打开工作室任选一个模型生成第一条视频,边跑边调参数,比先读完全文更快上手。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考