news 2026/9/9 23:14:07

免月费、400+ 模型可自托管:Open Generative AI 在浏览器里直接生成短片和口播视频

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
免月费、400+ 模型可自托管:Open Generative AI 在浏览器里直接生成短片和口播视频

免月费、400+ 模型可自托管:Open Generative AI 在浏览器里直接生成短片和口播视频

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

剪完片子想补一段电影感空镜,又不想再为平台月付掏订阅费——Open Generative AI 是一个开源的 AI 视频生成工作室,把 Flux、Kling、Sora、Veo 等 400 多个模型装到你能自托管的环境里,没有内容过滤器,也没有封闭生态。

一句话定位:它给"不想按月付费、也不想把提示词数据交给封闭云端"的个人创作者和小团队,提供一套 MIT 协议、可自托管的 AI 图像与视频生成工作台。

十分钟跑出第一个视频:四条路

在线版(建议先试这个):浏览器打开官方托管页面,注册一个免费账号即可,不用装任何东西,图像、视频、口型同步、Cinema、工作流等 14 个工作室直接在浏览器里用。

macOS:下载 DMG 拖进应用程序文件夹。应用没有苹果公证,首次打开会被 Gatekeeper 拦,右键选"打开"(或走"系统设置 → 隐私与安全性")一次即可,之后不再拦截。

Windows:运行 EXE 安装包,SmartScreen 弹窗点"更多信息"→"仍要运行",完事。

Linux:发布页有 AppImage 和 .deb。Ubuntu 24.04 以上用 AppImage 可能因 AppArmor 静默起不来,装自带 AppArmor 配置的 .deb 更稳。

从源码自托管(想二次开发才走这条):

git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI && npm run setup npm run dev # 网页版 http://localhost:3000;桌面版跑 npm run electron:dev

--recurse-submodules不能省(工作流和 Agent 两个包在子模块里),setup 没跑完 dev 也起不来。

本地推理方面,桌面应用内置两个引擎:随包附带的 sd.cpp(只支持图像模型,跑 Metal/CUDA/Vulkan/ROCm)和自己搭的 Gradio 服务 Wan2GP(跑视频模型)。硬件门槛一行带过:8GB 内存起步,16GB 更稳——Z-Image 权重加辅助文件超过 7GB,8GB 机器先用 2.1GB 的 SD 1.5 模型。注意本地推理仅限桌面端,网页版始终走云端 API。

从一句话到五秒视频

Video Studio 里写一句描述、挑模型:文本转视频有 40 多个可选,Kling、Sora、Veo、Wan、Seedance、Hailuo、Runway 都在。上传一张静态图,模式会自动切到图生视频(60 多个模型),这张图就作为首帧。选好消息比例和时长(部分模型支持 5/10/15 秒),提交后走"提交+轮询"流程,出片后一键下载原画。逻辑在 src/components/VideoStudio.js。

给已有画面重做口型

Lip Sync Studio 共 9 个模型、两种输入模式:一张肖像图加一段音频,直接产出说话视频;已有视频加音频,则重做口型,适合配音和本地化。分辨率按模型最高到 1080p,未跑完的任务刷新页面后会自动续上,不用守着。组件在 src/components/LipSyncStudio.js。

用提示词生成电影感镜头

Cinema Studio 把摄影参数翻译成提示词修饰:机身从 16mm 胶片到 70mm 大画幅再到 8K 数字,12 种镜头,焦段 8mm 到 85mm,光圈 f/1.4(浅景深)到 f/11(深焦)。

选"16mm+f/11",出来的画面就是复古胶片质感,做空镜很够用。参数配图在 public/assets/cinema/,逻辑在 src/components/CinemaStudio.js。

批量出一组分镜概念图

Image Studio 是双模式:默认 50 多个文生图模型,传参考图后自动切到 55 多个图生图模型;支持多图的编辑模型一次最多收 14 张参考图,勾选框带序号,按你选的顺序发给模型。传过的图存在本地历史里,跨会话复用,不用重复上传。多步任务可以进 Workflow Studio,把图像、视频、音频模型串成流水线,节点拖拽、社区模板、Playground 一键运行,适合批量出分镜概念。

全部 400 多个模型的定义集中在 packages/studio/src/models.js。

谁会用得上

一个人剪 Vlog 的 UP 主:剪完把静帧丢进图生视频补空镜,省掉每月给平台交的订阅费。

两三个人的前期小团队:先用 Cinema 参数批量出分镜帧和 5 秒预演片,统一视觉基调再交给剪辑。

自托管爱好者:MIT 协议、数据留在自己机器上,加自己的模型、改界面都有源码可动。

第一次用的坑

云模型走统一 API,首次使用要填一个 access key;只想玩本地 sd.cpp 的话可以跳过。8GB 内存的机器别碰 Z-Image——官方 README 里自己承认会卡死系统,先用 2.1GB 的 Dreamshaper 8 跑通。Wan2GP 不带 Python 也不带权重,得在 CUDA/ROCm 的 GPU 机器上跑 Gradio 服务,再把 URL 粘进设置里点测试。macOS 首启被拦,终端跑一句xattr -cr "/Applications/Open Generative AI.app"就解除;Ubuntu 24.04 的 AppImage 静默退出,换 .deb。多图模式里顺序是有意义的,模型按你勾选的次序读图;参考图传过一次就能从历史里复用,不存在反复上传翻车的问题。

技术栈速览

网页端 Next.js 14(App Router)+React 18+Tailwind v3,桌面端 Vite+Electron,npm workspaces 单仓库,packages/studio/ 是共享组件库。每个工作室就是一个独立组件,加模型和改界面都有单一入口;API 客户端在 src/lib/muapi.js,提交+轮询两步走。

MIT 协议、14 个工作室、400 多个模型,这就是 Open Generative AI 目前的体量。把仓库克隆下来,npm run setup && npm run dev,第一条文生视频一般三分钟内见片;安装细节和问题追踪都在仓库 README 里,作者也在 README 顶部留了 Discord 入口。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/9 23:12:32

OpenClaw 7分钟部署教程:云服务器/Mac/Linux/Win11全平台实测

2026年3月实测:OpenClaw 7分钟部署教程,云上/Mac/Linux/Win11全流程 先说结论:OpenClaw 这东西,如果你只是听说、还没动手,2026年现在正是入坑的好时机。我3月初在腾讯云轻量服务器、Mac mini、Ubuntu 工作站和一台 Wi…

作者头像 李华
网站建设 2026/9/9 23:11:23

动态社区发布视频加载慢?从索引到异步化全面优化指南

在实际的社区类产品里,“动态太多导致发布视频加载慢”是一个很典型的性能问题。很多团队收到用户反馈后,第一反应是清理历史动态,甚至有人会开玩笑说“朋友,请删掉一些动态吧”。但真正的问题是:为什么动态数据量变大…

作者头像 李华
网站建设 2026/9/9 23:10:19

Windows 11 广告清理指南:彻底关闭推荐与推送的完整方案

最近不少朋友找我吐槽:新买的 Windows 11 电脑,用不到一周就开始“闹情绪”——开始菜单推荐区冒出一堆没用过的软件,锁屏界面时不时教你“小技巧”,设置主页催你“完成设备设置”,连文件资源管理器都开始推销 Microso…

作者头像 李华
网站建设 2026/9/9 23:09:31

HCL AppScan Standard 10.10.0:强化SPA与API安全测试能力

HCL AppScan Standard这名字,搞Web安全测试的朋友应该不陌生。圈子里叫它AppScan,是DAST(动态应用安全测试)领域的老牌工具,从IBM时代一路走到HCL手里,依然保持着比较高频的版本迭代节奏。最近这波10.10.0发…

作者头像 李华
网站建设 2026/9/9 23:09:20

Redis安全加固:从requirepass到ACL的密码配置全指南

你在生产环境里见过不设置密码的Redis吗?我见过,而且是在一场惨烈的故障里。当时一台低配服务器上跑着一个业务量不大的Redis实例,开发图省事没配密码,只做了内网IP绑定。结果某天下午这台服务器CPU飙到100%,上去一看&…

作者头像 李华
网站建设 2026/9/9 23:06:03

10 分钟装好 DeepTutor:把本地 AI 导师接进你的学习资料

10 分钟装好 DeepTutor:把本地 AI 导师接进你的学习资料 【免费下载链接】DeepTutor DeepTutor: Lifelong Personalized Tutoring. https://deeptutor.info/. 项目地址: https://gitcode.com/GitHub_Trending/dee/DeepTutor 啃到第 60 页,公式还在…

作者头像 李华