Open Generative AI:600+ 模型的免费 AI 视频生成工作室,文字到成片快速跑通
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open Generative AI 是一款开源免费的 AI 视频生成工作室,内置 600 多个模型(Flux、Midjourney、Kling、Sora、Veo 都能调),没有内容过滤器,可自托管,MIT 许可证。
它替你解决什么
做一条带货短视频,过去要干三件事:先找个工具出图,再找个工具出视频,最后再找一个做口型。每个工具都要注册、订阅、付费,数据还都散落在不同平台。
配音本地化也一样。想给成片换个语言版本,得先剪出人物画面,再找口型工具重对,来回导出好几遍。
想要电影感?普通提示词很难控制景深和焦段,反复抽卡也不稳定。
Open Generative AI 把这几件事收进一个开源工具里:文字、图像、视频、口型、镜头参数、工作流都在同一套界面完成,模型随便挑,数据放在你自己手里。
从输入到成片,它怎么干活
📍 按你的创作顺序,这条流水线是这么走的:
第一步,文字出画面。在图像工作室里直接写一句提示词,它就帮你出首帧。没传图时它用 50 多个文生图模型;一旦你拖入参考图,立刻切到 55 多个图生图模型。两种模式自动切换,不用你手动选。
第二步,让画面动起来。视频工作室沿用同一套思路:40 多个文生视频模型负责从文字直接出片,60 多个图生视频模型负责把静帧"拍"成镜头。核心逻辑写在 src/components/VideoStudio.js。
第三步,给角色开口。需要人物说话时,进唇形同步工作室。两种玩法:拿一张肖像图配一段音频,直接生成说话视频;或者拿现有视频加新音频,重对口型。配音、多语言版本就在这里批量产出。代码在 src/components/LipSyncStudio.js。
第四步,调镜头质感。电影工作室让你选相机类型、镜头、焦距、光圈。这些参数会自动翻译成提示词修饰符,景深和焦段感不用靠运气。
第五步,把流程钉死。工作流工作室是拖放式的:把前面每一步连成一条线,上一步的输出直接喂给下一步,整套媒体处理流程不用写代码。
三步跑起来
- 装桌面版:macOS 拖 DMG 进应用程序,Windows 用 NSIS 安装包(x64/ARM64 都有),Linux 用 AppImage 或 DEB 包。
- 不想装?打开在线版就行,生成、图转视频、口型这些核心能力都在,零安装。
- 配密钥:在设置里填 MuAPI API 密钥;走本地模型的话,这一步可以直接跳过。
进阶与定制
🔌 三条路线,按需选:
- 本地推理:sd.cpp 引擎随应用捆绑,跑在你机器上,Metal(Apple Silicon)、CUDA、Vulkan、ROCm 都能用;Wan2GP 是远程路线,需要一台带 CUDA 或 ROCm GPU 的机器常驻服务器。相关实现在 electron/lib/localInferenceRuntime.js、electron/lib/wan2gpProvider.js。
- API 集成:通信分两步——POST 提交提示词和参数,再 GET 轮询直到状态完成,方便接进自己的系统。入口在 src/lib/muapi.js。
- 二次开发:MIT 许可证允许商用和修改。想加新模型、改界面或加功能,直接在组件上动手即可。
少踩坑
生成卡住了?先查网络和密钥这两处,然后把分辨率调低、换轻量模型,一般就能过。
画面不够好?把提示词写具体,再喂一张高质量参考图;风格不对就换模型组合试。
本地推理慢?确认 GPU 加速已启用(Apple Silicon 上开 Metal),内存最低 8GB,16GB 以上更稳。
文件找不到了?上传的图都留在本地上传历史里,生成记录存在浏览器中,随时能回看下载。
Open Generative AI 把文字、图像、视频、口型、镜头和工作流捏进了一个工具,本地能跑、数据归你、MIT 免费商用。现在就用一句提示词,跑通你的第一条 AI 视频。 </输出文章>
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考