news 2026/9/4 14:02:42

Open Generative AI:免费开源AI绘图与视频生成工作室,400+模型一键从文字到视频

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Open Generative AI:免费开源AI绘图与视频生成工作室,400+模型一键从文字到视频

Open Generative AI:免费开源AI绘图与视频生成工作室,400+模型一键从文字到视频

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

Open Generative AI 是一个免费的开源 AI 创作工作室,把 AI 绘图、视频生成、口型同步放在同一个界面里完成,适合想跳过付费订阅和封闭平台的内容创作者。它内置 Flux、Midjourney、Kling、Sora、Veo 等 400 多个模型,覆盖文生图、文生视频、图生视频全链路,没有内容过滤器,代码以 MIT 协议完全开放。

三分钟跑起来:三种上手路径

按你的需求选一条路,几分钟内就能开始生成。

  • 在线版:官方托管版本,浏览器打开即用,全部工作室功能可用,无需安装和配置。
  • 桌面应用:macOS(Apple Silicon/Intel)、Windows、Linux 都有安装包,本地推理功能只有这一版提供。
  • 源码部署:适合二次开发,克隆仓库并安装依赖即可,需要 Node.js 18+。
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run dev

npm run dev启动网页版,npm run electron:dev启动桌面应用。首次启动会提示填写 API 密钥,只用本地模型可以跳过。

能力全景:14 个工作室一览

AI创作工作室的主界面

模块一句话说明关键数字
图像工作室上传参考图与否自动切换模型集70+ 文生图、70+ 图生图
视频工作室文字出片或首帧图出片,双模式85+ 文生视频、120+ 图生视频
口型同步工作室肖像或现有视频配音频,生成讲话视频9 个专用模型,最高 1080p
电影工作室虚拟专业相机,镜头、焦距、光圈全可控6 种机身、11 支镜头
工作流工作室拖拽节点串联多步 AI 管道内置模板 + 社区分享
智能体工作室对话式规划并执行生成任务多轮创意 Agent
本地推理双引擎跑在自己硬件上,无需云 APIsd.cpp 内置 + Wan2GP 远程
多图像输入多张参考图做风格融合与编辑最多 14 张

其余还包括 AI 网红、营销素材、音频、AI 剪辑、Vibe Motion 动效、角色重制等工作室。所有历史生成记录保存在本地,可一键下载原图。

三个特色功能细看

多图像融合编辑:一次喂 14 张参考图

多数图像模型只接受一张参考图,"风格 A + 构图 B + 角色 C"的融合需求很难落地。多图像模型打破了这个上限:选中 Nano Banana 2 Edit 后,一次最多上传 14 张参考图,按你选择的顺序送入模型。

  • 顺序编号:图片按勾选顺序发送,风格占比可控
  • 批量上传:文件对话框里一次选多张,不用逐张操作
  • 上传历史:用过的图自动存成本地缩略图库,跨会话复用
  • 兼容模型:Nano Banana 2 Edit(14 张)、Nano Banana Edit、Flux Kontext Dev、GPT-4o Edit 等

AI图像生成的高清效果示例

电影工作室:虚拟专业相机控制

电影工作室面向想要"电影感"画面的场景。它模拟真实拍摄系统,把你的选择翻译成精确的提示词修饰,出片的光学风格稳定可复现。

  • 机身:全画幅电影数字到 70mm 大画幅胶片共 6 种
  • 镜头:70s Cinema Prime、旋流散景、Halation 等 11 支
  • 焦距:8mm 超广角到 85mm 人像长焦,6 档可选
  • 光圈:f/1.4 浅景深、f/4 均衡、f/11 深焦三档

f/1.4 浅景深电影感效果

本地推理双引擎:数据不出自己的电脑

桌面应用内置两套独立推理引擎,按硬件二选一,全程不消耗云端 API,反复试错零成本。

  • sd.cpp(内置):C++ 引擎直接跑在本机,Apple Silicon Metal 加速最佳,也支持 CUDA/Vulkan/ROCm,覆盖 SD 1.5、SDXL、Z-Image 等图像模型
  • Wan2GP(远程服务器):指向自己的 GPU 服务器,解锁 Flux.1 Dev、Qwen Image、Wan 2.2 等视频模型
  • 选择逻辑:M 系列 Mac 直接上 sd.cpp;局域网或云上有一台 NVIDIA/AMD GPU 机器就配 Wan2GP

组合技:3 个跨模块真实工作流

会说话的短视频

  1. 在图像工作室生成人物肖像和配套场景
  2. 到口型同步工作室,上传肖像加录好的音频,生成讲话视频
  3. 换不同模型各跑一版,对比口型自然度
  4. 时长不够时用 Seedance 2.0 Extend 一类模型续接

文本转视频的电影感效果

角色一致的视觉资产

  1. 图像工作室选择 Nano Banana 2 Edit 等多图模型
  2. 上传 3~5 张参考图:角色、风格、构图、背景
  3. 提示词写明"角色取自第 1 张,风格参照第 2 张"
  4. 批量出图,逐步积累同一角色的资产库

电影级镜头高效迭代

  1. 电影工作室锁定镜头:机身、镜头、f/4 光圈、35mm 焦距
  2. 先出静帧确认构图和景深
  3. 切到视频工作室的图生视频模式,让画面动起来
  4. 需要批量试参数时切到本地引擎,省 API 调用

硬件与本地推理配置指南

档位配置说明
最低8GB 内存可跑 SD 1.5 类模型,如 Dreamshaper 8
推荐16GB 以上支持 Z-Image Turbo 等大模型

两条最实用的建议:

  • 8GB 内存的 Mac 上避开 Z-Image(已知会卡死系统),先用 SD 1.5 验证流程
  • 模型文件占用大时,启动前设置OPEN_GENERATIVE_AI_LOCAL_AI_DIR环境变量,把模型目录指到别的磁盘

二次开发入口

  • packages/studio/src/models.js:400+ 模型定义的唯一事实来源
  • packages/studio/src/muapi.js:统一 API 客户端
  • packages/studio/src/components/:ImageStudio、VideoStudio 等工作室 UI
  • packages/Vibe-Workflow/:可视化工作流引擎
  • electron/:桌面应用与本地推理集成

扩展路径:在models.js加模型定义,再到对应工作室组件补 UI 选项,用 API 联调即可生效。

高频问题速答

Q:硬件要求是什么?A:云端模型不挑硬件;本地推理最低 8GB 内存,推荐 16GB 以上,并配备支持 Metal、CUDA、Vulkan 或 ROCm 的 GPU。

Q:需要会编程吗?A:不需要。在线版和桌面应用都是纯图形界面,只有二次开发或自托管部署时才需要读代码。

Q:和商用 AI 视频平台差在哪?A:三点:免费开源(MIT)、无内容过滤器、可自托管;模型池横跨 400+ 个,而不是平台自带的几款。

Q:有内容限制吗?A:项目本身不设内容过滤器,也不拦截提示词;具体某家模型的可用性取决于其 API 条款,商用模型注意合规。

Q:如何保证生成质量?A:按任务选模型:叙事场景用文生视频,精细控制用图生视频,再按模型能力调宽高比、分辨率和时长,本地引擎适合多版本对比。

现在开始

免费、开源、可自托管加上 400+ 模型池,这在创作工具里不多见。打开工作室,输入第一句文字,几分钟就能看到成片。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/4 14:02:31

5分钟搞定终端配色:450+护眼主题怎么选、怎么装

5分钟搞定终端配色:450护眼主题怎么选、怎么装 【免费下载链接】iTerm2-Color-Schemes Over 450 terminal color schemes/themes for iTerm/iTerm2. Includes ports to Terminal, Konsole, PuTTY, Xresources, XRDB, Remmina, Termite, XFCE, Tilda, FreeBSD VT, Te…

作者头像 李华
网站建设 2026/9/4 13:57:35

184、51单片机无线NRF24L01防丢器无线寻物时钟语音播报震动防丢失报警(程序+原理图+PCB源文件+程序流程图+参考论文+开题报告+元件清单等)

毕设帮助、开题指导、技术解答(有偿)见文未 目录 一、硬件方案 二、设计功能 三、实物图 四、原理图 五、PCB图 六、程序源码 资料包括: 需要完整的资料可以点击下面的名片加下我,找我要资源压缩包的百度网盘下载地址及提取码。 方案选择 单片机…

作者头像 李华
网站建设 2026/9/4 13:56:21

超全Windows 10使用技巧

目录: 一、截图功能 1、快捷键WinShiftS 2、使用键盘快捷键截图 3、Microsoft Edge浏览器截图 二、输入法 1、微软五笔与拼音混合 2、默认英文设置 三、彻底关闭Win10更新 四、恢复自带的翻译功能 五、关闭“联想酷生活” 六、去除登录与睡眠唤醒密码 1…

作者头像 李华
网站建设 2026/9/4 13:55:53

基于JavaParser构建代码调用链分析工具:从死锁排查到架构洞察

简介:本资源是一套基于JavaParser实现的代码调用链静态分析实践方案,面向Java中高级开发者、代码质量工程师及静态分析学习者,解决大型Java项目中方法调用关系梳理难、性能瓶颈定位慢、重构依赖不清等实际问题。压缩包共126个文件&#xff08…

作者头像 李华
网站建设 2026/9/4 13:55:29

MoneyPrinterTurbo:只给1个主题,AI 视频生成工具如何 3 分钟出成片

MoneyPrinterTurbo:只给1个主题,AI 视频生成工具如何 3 分钟出成片 【免费下载链接】MoneyPrinterTurbo 利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an auto…

作者头像 李华