Open Generative AI:免费开源AI绘图与视频生成工作室,400+模型一键从文字到视频
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
Open Generative AI 是一个免费的开源 AI 创作工作室,把 AI 绘图、视频生成、口型同步放在同一个界面里完成,适合想跳过付费订阅和封闭平台的内容创作者。它内置 Flux、Midjourney、Kling、Sora、Veo 等 400 多个模型,覆盖文生图、文生视频、图生视频全链路,没有内容过滤器,代码以 MIT 协议完全开放。
三分钟跑起来:三种上手路径
按你的需求选一条路,几分钟内就能开始生成。
- 在线版:官方托管版本,浏览器打开即用,全部工作室功能可用,无需安装和配置。
- 桌面应用:macOS(Apple Silicon/Intel)、Windows、Linux 都有安装包,本地推理功能只有这一版提供。
- 源码部署:适合二次开发,克隆仓库并安装依赖即可,需要 Node.js 18+。
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run devnpm run dev启动网页版,npm run electron:dev启动桌面应用。首次启动会提示填写 API 密钥,只用本地模型可以跳过。
能力全景:14 个工作室一览
AI创作工作室的主界面
| 模块 | 一句话说明 | 关键数字 |
|---|---|---|
| 图像工作室 | 上传参考图与否自动切换模型集 | 70+ 文生图、70+ 图生图 |
| 视频工作室 | 文字出片或首帧图出片,双模式 | 85+ 文生视频、120+ 图生视频 |
| 口型同步工作室 | 肖像或现有视频配音频,生成讲话视频 | 9 个专用模型,最高 1080p |
| 电影工作室 | 虚拟专业相机,镜头、焦距、光圈全可控 | 6 种机身、11 支镜头 |
| 工作流工作室 | 拖拽节点串联多步 AI 管道 | 内置模板 + 社区分享 |
| 智能体工作室 | 对话式规划并执行生成任务 | 多轮创意 Agent |
| 本地推理 | 双引擎跑在自己硬件上,无需云 API | sd.cpp 内置 + Wan2GP 远程 |
| 多图像输入 | 多张参考图做风格融合与编辑 | 最多 14 张 |
其余还包括 AI 网红、营销素材、音频、AI 剪辑、Vibe Motion 动效、角色重制等工作室。所有历史生成记录保存在本地,可一键下载原图。
三个特色功能细看
多图像融合编辑:一次喂 14 张参考图
多数图像模型只接受一张参考图,"风格 A + 构图 B + 角色 C"的融合需求很难落地。多图像模型打破了这个上限:选中 Nano Banana 2 Edit 后,一次最多上传 14 张参考图,按你选择的顺序送入模型。
- 顺序编号:图片按勾选顺序发送,风格占比可控
- 批量上传:文件对话框里一次选多张,不用逐张操作
- 上传历史:用过的图自动存成本地缩略图库,跨会话复用
- 兼容模型:Nano Banana 2 Edit(14 张)、Nano Banana Edit、Flux Kontext Dev、GPT-4o Edit 等
AI图像生成的高清效果示例
电影工作室:虚拟专业相机控制
电影工作室面向想要"电影感"画面的场景。它模拟真实拍摄系统,把你的选择翻译成精确的提示词修饰,出片的光学风格稳定可复现。
- 机身:全画幅电影数字到 70mm 大画幅胶片共 6 种
- 镜头:70s Cinema Prime、旋流散景、Halation 等 11 支
- 焦距:8mm 超广角到 85mm 人像长焦,6 档可选
- 光圈:f/1.4 浅景深、f/4 均衡、f/11 深焦三档
f/1.4 浅景深电影感效果
本地推理双引擎:数据不出自己的电脑
桌面应用内置两套独立推理引擎,按硬件二选一,全程不消耗云端 API,反复试错零成本。
- sd.cpp(内置):C++ 引擎直接跑在本机,Apple Silicon Metal 加速最佳,也支持 CUDA/Vulkan/ROCm,覆盖 SD 1.5、SDXL、Z-Image 等图像模型
- Wan2GP(远程服务器):指向自己的 GPU 服务器,解锁 Flux.1 Dev、Qwen Image、Wan 2.2 等视频模型
- 选择逻辑:M 系列 Mac 直接上 sd.cpp;局域网或云上有一台 NVIDIA/AMD GPU 机器就配 Wan2GP
组合技:3 个跨模块真实工作流
会说话的短视频
- 在图像工作室生成人物肖像和配套场景
- 到口型同步工作室,上传肖像加录好的音频,生成讲话视频
- 换不同模型各跑一版,对比口型自然度
- 时长不够时用 Seedance 2.0 Extend 一类模型续接
文本转视频的电影感效果
角色一致的视觉资产
- 图像工作室选择 Nano Banana 2 Edit 等多图模型
- 上传 3~5 张参考图:角色、风格、构图、背景
- 提示词写明"角色取自第 1 张,风格参照第 2 张"
- 批量出图,逐步积累同一角色的资产库
电影级镜头高效迭代
- 电影工作室锁定镜头:机身、镜头、f/4 光圈、35mm 焦距
- 先出静帧确认构图和景深
- 切到视频工作室的图生视频模式,让画面动起来
- 需要批量试参数时切到本地引擎,省 API 调用
硬件与本地推理配置指南
| 档位 | 配置 | 说明 |
|---|---|---|
| 最低 | 8GB 内存 | 可跑 SD 1.5 类模型,如 Dreamshaper 8 |
| 推荐 | 16GB 以上 | 支持 Z-Image Turbo 等大模型 |
两条最实用的建议:
- 8GB 内存的 Mac 上避开 Z-Image(已知会卡死系统),先用 SD 1.5 验证流程
- 模型文件占用大时,启动前设置
OPEN_GENERATIVE_AI_LOCAL_AI_DIR环境变量,把模型目录指到别的磁盘
二次开发入口
packages/studio/src/models.js:400+ 模型定义的唯一事实来源packages/studio/src/muapi.js:统一 API 客户端packages/studio/src/components/:ImageStudio、VideoStudio 等工作室 UIpackages/Vibe-Workflow/:可视化工作流引擎electron/:桌面应用与本地推理集成
扩展路径:在models.js加模型定义,再到对应工作室组件补 UI 选项,用 API 联调即可生效。
高频问题速答
Q:硬件要求是什么?A:云端模型不挑硬件;本地推理最低 8GB 内存,推荐 16GB 以上,并配备支持 Metal、CUDA、Vulkan 或 ROCm 的 GPU。
Q:需要会编程吗?A:不需要。在线版和桌面应用都是纯图形界面,只有二次开发或自托管部署时才需要读代码。
Q:和商用 AI 视频平台差在哪?A:三点:免费开源(MIT)、无内容过滤器、可自托管;模型池横跨 400+ 个,而不是平台自带的几款。
Q:有内容限制吗?A:项目本身不设内容过滤器,也不拦截提示词;具体某家模型的可用性取决于其 API 条款,商用模型注意合规。
Q:如何保证生成质量?A:按任务选模型:叙事场景用文生视频,精细控制用图生视频,再按模型能力调宽高比、分辨率和时长,本地引擎适合多版本对比。
现在开始
免费、开源、可自托管加上 400+ 模型池,这在创作工具里不多见。打开工作室,输入第一句文字,几分钟就能看到成片。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考