Open Generative AI 完整指南:用 420+ 个模型免费生成 AI 图像与视频 📅 发布时间:2026/9/4 12:19:44 👁 浏览次数: Open Generative AI 完整指南用 420 个模型免费生成 AI 图像与视频【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个 MIT 协议的免费开源 AI 图像与视频生成工作室把 Flux、Midjourney、Kling、Sora、Veo 等 420 多个主流模型收进 14 个独立工作室。没有订阅费、没有内容过滤整套系统可以自托管。下面按先跑起来、再做东西、最后调优的顺序把它的用法完整讲一遍。十分钟上手三种启动方式按需求挑在线版——官方托管站点提供完整的 14 个工作室图像、视频、音频、口型同步、电影、工作流、Agent 等注册免费账号就能在浏览器里用零配置。桌面版——macOSApple Silicon 和 Intel 都有 DMG、WindowsNSIS 安装器、LinuxAppImage / deb提供一键安装包不需要装 Node.js。源码部署——想改代码或接入自己的模型清单走这条路需要 Node.js 18git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run devnpm run dev启动 Web 版Next.js端口 3000想要桌面形态就把最后一步换成npm run electron:dev。注意--recurse-submodules不能省工作流和 Agent 包都在子模块里漏掉会报找不到 pages 目录。首次启动会让你填 Muapi API key如果只想用本地模型可以先跳过。做图只输文字和上传参考图走两套完全不同的模型图像工作室Image Studio的切换逻辑很直接不传图默认文生图模式50 个 t2i 模型可选——Flux、Nano Banana 2支持 1K/2K/4K 分辨率、Seedream 5.0、Ideogram、GPT-4o、Midjourney v7传了参考图自动切到 55 个 i2i 模型——Flux Kontext、Nano Banana 2 Edit、Seedream 5.0 Edit、Seededit、超分辨率、背景移除真正拉开差距的是多参考图能力。Nano Banana 2 Edit 一次最多吃14 张参考图Flux Kontext Dev、Kling O1 Edit、GPT-4o Edit 支持 10 张Vidu Q2 支持 7 张。选中多图模型后上传按钮变成多选模式每张图带顺序编号模型按你选定的顺序处理批量勾选、Use Selected 确认一套流程走完。所有上传过的参考图会存进本地上传历史localStorage 持久化下次直接点缩略图复用同一张图不用反复传。做视频40 文生视频、60 图生视频、9 个口型同步模型视频工作室和图像工作室是同一套双模式设计文生视频40 模型Kling、Sora 2、Veo 3、Wan、Seedance 2.05/10/15 秒三档时长、Hailuo、Runway输入场景描述直接出片图生视频60 模型上传一张起始帧动画化Kling I2V、Veo3 I2V、Runway I2V、Midjourney I2V 都在池子里口型同步让照片开口说话Lip Sync 工作室是差异化最大的模块之一9 个模型分两条路径输入输出代表模型肖像图 音频说话视频Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync最高 1080p现有视频 音频对口型视频LatentSync、Sync、Veed、Creatify、Infinite Talk V2V第二条路径就是做视频配音、多语种换声的常规打法原片不动只重绘嘴部。生成记录单独存页面刷新后未完成的任务会自动恢复轮询。电影工作室把相机参数搬进提示词Cinema Studio 把虚拟摄影棚做成了参数面板每个选择最终都会翻译成优化的提示词修饰符机身Modular 8K 数字、全画幅电影机、70mm 大画幅胶片、Studio S35、经典 16mm 胶片等镜头70s Cinema Prime复古质感、Swirl Bokeh Portrait旋流散景、Halation Diffusion辉光、Clinical Sharp Prime锐利临床风等 11 款焦距8mm 超广角 → 14 / 24 / 35mm人眼视角/ 50mm人像/ 85mm 特写光圈f/1.4 浅景深突出主体、f/4 均衡、f/11 深焦前后都实对应组件在 src/components/CinemaStudio.js配套的镜头/光圈样张资源在public/assets/cinema/下。不烧云端额度两套本地推理引擎桌面应用内置两个互相独立的本地引擎都在Settings → Local Models里配置生成时点模型选择器旁边的 ⚡ Local 开关即可不需要 API key。sd.cpp捆绑下载来自 stable-diffusion.cpp 的 C 引擎Apple Silicon 走 MetalLinux/Windows 走 CUDA/Vulkan/ROCm。可选模型Z-Image Turbo8 步出图、Z-Image Base50 步高质量、Dreamshaper 8 / Realistic Vision v5.1 / Anything v5SD 1.5各约 2.1 GB、SDXL Base6.9 GB。Wan2GP自带服务器应用本身只是 HTTP 客户端你在有 CUDA/ROCm GPU 的机器上跑 Wan2GP 的 Gradio 服务桌面端填 URL 后测连通性。好处是 Mac 用户也能把推理甩给局域网里的游戏本或租来的 GPU 实例。可用模型Flux.1 Dev、Qwen Image、Wan 2.2T2V/I2V、Hunyuan Video、LTX Video。硬件与存储的三个坑8GB 内存的 M 系列 Mac 别碰 Z-Image——官方明确说会卡死系统用 SD 1.5 系约 2GB就够Z-Image 建议 16GB 起步模型权重默认存在 Electron 应用数据目录想挪到别的磁盘就启动前设环境变量export OPEN_GENERATIVE_AI_LOCAL_AI_DIR/path/to/local-ai本地推理只有桌面版支持托管 Web 版永远走云端 API搭流水线Workflow Studio 把模型串起来工作流工作室解决单模型不够用的问题——把图像、视频、音频模型串成自动化管道模板库预置图像链、视频管道等起点模板节点编辑器拖拽连线决定上一步输出喂给哪个模型社区区跑别人发布的管道Playground表单式交互式运行结果内联渲染API 调用每条工作流都能通过 Muapi API 执行方便接进自己的系统底层引擎是独立的开源包 packages/Vibe-Workflow/可以单独抽出来嵌进其他项目。开发者视角三个文件读懂整个架构这是个 Next.js monorepo共享的组件库在packages/studio。改东西之前先看这三个入口packages/studio/src/models.js——全部 400 模型定义的唯一事实源t2i / i2i / t2v / i2v / v2v / 口型同步 / 重绘 / 音频按数组分开导出加新模型就在这里登记桌面版和托管版同时生效packages/studio/src/muapi.js——统一 API 客户端调用模式是提交POST /api/v1/{endpoint}→ 轮询 predictions 结果直到 completed认证走x-api-key头packages/studio/src/components/——ImageStudio、VideoStudio、CinemaStudio、WorkflowStudio 等各工作室 UIStandaloneShell.js 负责顶部 Tab 导航和 API key 管理克隆仓库跑一遍npm run setup14 个工作室就能在本地转起来先用在线版或桌面版找到你常用的三个工作室再决定要不要碰源码。从 Cinema 工作室的参数面板开始玩它是理解提示词工程 参数控制这套思路最快的地方。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考