免月费、400+ 模型可自托管:Open Generative AI 在浏览器里直接生成短片和口播视频
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
剪完片子想补一段电影感空镜,又不想再为平台月付掏订阅费——Open Generative AI 是一个开源的 AI 视频生成工作室,把 Flux、Kling、Sora、Veo 等 400 多个模型装到你能自托管的环境里,没有内容过滤器,也没有封闭生态。
一句话定位:它给"不想按月付费、也不想把提示词数据交给封闭云端"的个人创作者和小团队,提供一套 MIT 协议、可自托管的 AI 图像与视频生成工作台。
十分钟跑出第一个视频:四条路
在线版(建议先试这个):浏览器打开官方托管页面,注册一个免费账号即可,不用装任何东西,图像、视频、口型同步、Cinema、工作流等 14 个工作室直接在浏览器里用。
macOS:下载 DMG 拖进应用程序文件夹。应用没有苹果公证,首次打开会被 Gatekeeper 拦,右键选"打开"(或走"系统设置 → 隐私与安全性")一次即可,之后不再拦截。
Windows:运行 EXE 安装包,SmartScreen 弹窗点"更多信息"→"仍要运行",完事。
Linux:发布页有 AppImage 和 .deb。Ubuntu 24.04 以上用 AppImage 可能因 AppArmor 静默起不来,装自带 AppArmor 配置的 .deb 更稳。
从源码自托管(想二次开发才走这条):
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI && npm run setup npm run dev # 网页版 http://localhost:3000;桌面版跑 npm run electron:dev--recurse-submodules不能省(工作流和 Agent 两个包在子模块里),setup 没跑完 dev 也起不来。
本地推理方面,桌面应用内置两个引擎:随包附带的 sd.cpp(只支持图像模型,跑 Metal/CUDA/Vulkan/ROCm)和自己搭的 Gradio 服务 Wan2GP(跑视频模型)。硬件门槛一行带过:8GB 内存起步,16GB 更稳——Z-Image 权重加辅助文件超过 7GB,8GB 机器先用 2.1GB 的 SD 1.5 模型。注意本地推理仅限桌面端,网页版始终走云端 API。
从一句话到五秒视频
Video Studio 里写一句描述、挑模型:文本转视频有 40 多个可选,Kling、Sora、Veo、Wan、Seedance、Hailuo、Runway 都在。上传一张静态图,模式会自动切到图生视频(60 多个模型),这张图就作为首帧。选好消息比例和时长(部分模型支持 5/10/15 秒),提交后走"提交+轮询"流程,出片后一键下载原画。逻辑在 src/components/VideoStudio.js。
给已有画面重做口型
Lip Sync Studio 共 9 个模型、两种输入模式:一张肖像图加一段音频,直接产出说话视频;已有视频加音频,则重做口型,适合配音和本地化。分辨率按模型最高到 1080p,未跑完的任务刷新页面后会自动续上,不用守着。组件在 src/components/LipSyncStudio.js。
用提示词生成电影感镜头
Cinema Studio 把摄影参数翻译成提示词修饰:机身从 16mm 胶片到 70mm 大画幅再到 8K 数字,12 种镜头,焦段 8mm 到 85mm,光圈 f/1.4(浅景深)到 f/11(深焦)。
选"16mm+f/11",出来的画面就是复古胶片质感,做空镜很够用。参数配图在 public/assets/cinema/,逻辑在 src/components/CinemaStudio.js。
批量出一组分镜概念图
Image Studio 是双模式:默认 50 多个文生图模型,传参考图后自动切到 55 多个图生图模型;支持多图的编辑模型一次最多收 14 张参考图,勾选框带序号,按你选的顺序发给模型。传过的图存在本地历史里,跨会话复用,不用重复上传。多步任务可以进 Workflow Studio,把图像、视频、音频模型串成流水线,节点拖拽、社区模板、Playground 一键运行,适合批量出分镜概念。
全部 400 多个模型的定义集中在 packages/studio/src/models.js。
谁会用得上
一个人剪 Vlog 的 UP 主:剪完把静帧丢进图生视频补空镜,省掉每月给平台交的订阅费。
两三个人的前期小团队:先用 Cinema 参数批量出分镜帧和 5 秒预演片,统一视觉基调再交给剪辑。
自托管爱好者:MIT 协议、数据留在自己机器上,加自己的模型、改界面都有源码可动。
第一次用的坑
云模型走统一 API,首次使用要填一个 access key;只想玩本地 sd.cpp 的话可以跳过。8GB 内存的机器别碰 Z-Image——官方 README 里自己承认会卡死系统,先用 2.1GB 的 Dreamshaper 8 跑通。Wan2GP 不带 Python 也不带权重,得在 CUDA/ROCm 的 GPU 机器上跑 Gradio 服务,再把 URL 粘进设置里点测试。macOS 首启被拦,终端跑一句xattr -cr "/Applications/Open Generative AI.app"就解除;Ubuntu 24.04 的 AppImage 静默退出,换 .deb。多图模式里顺序是有意义的,模型按你勾选的次序读图;参考图传过一次就能从历史里复用,不存在反复上传翻车的问题。
技术栈速览
网页端 Next.js 14(App Router)+React 18+Tailwind v3,桌面端 Vite+Electron,npm workspaces 单仓库,packages/studio/ 是共享组件库。每个工作室就是一个独立组件,加模型和改界面都有单一入口;API 客户端在 src/lib/muapi.js,提交+轮询两步走。
MIT 协议、14 个工作室、400 多个模型,这就是 Open Generative AI 目前的体量。把仓库克隆下来,npm run setup && npm run dev,第一条文生视频一般三分钟内见片;安装细节和问题追踪都在仓库 README 里,作者也在 README 顶部留了 Discord 入口。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考