Open Generative AI:免费开源的 AI 视频生成工作室,400+ 模型可自托管

Open Generative AI:免费开源的 AI 视频生成工作室,400+ 模型可自托管 Open Generative AI免费开源的 AI 视频生成工作室400 模型可自托管【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个免费、开源的 AI 视频生成工作室MIT 协议接入 Flux、Midjourney、Kling、Sora、Veo 等 400 模型支持文生视频、图生视频、唇形同步等生成方式没有内容过滤器可以完整自托管数据留在自己的机器上。适合短视频创作者、影视爱好者和在意隐私的开发者。快速上手这一节能让你用最短时间跑起来一个可用的 Open Generative AI按零安装到自托管从轻到重排了三种方式。方式一网页版零安装。项目官方提供一个托管在线版本浏览器打开就能用全部 14 个工作室图像、视频、唇形同步、工作流等注册免费账号即可开始生成。网页版走云端 API对本地硬件没有任何要求适合先体验再决定要不要部署。方式二桌面应用推荐大多数人用。官方提供预构建安装包不需要 Node.js 和终端macOS 是 DMG分 Intel 和 Apple Silicon 两个版本Windows 是 x64 安装包Linux 有 AppImage 和 .deb 两种。macOS 首次启动被 Gatekeeper 拦下时不用担心应用只是没有做公证去系统设置的「隐私与安全性」里点「仍要打开」就行全程不用敲命令Windows SmartScreen 弹窗点「更多信息 → 仍要运行」即可。方式三从源码构建。需要 Node.js 18。先执行git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI必须带子模块工作流和智能体包都在子模块里再执行npm run setup安装依赖并构建工作区子包这一步不能省只跑 npm install 是不够的。之后跑 npm run dev 启动网页版浏览器访问 localhost:3000 就是完整应用。首次使用只需要配一项启动时会提示输入 Muapi API 密钥粘贴到设置界面即可如果只打算用本地模型这一步可以直接跳过。密钥只保存在浏览器 localStorage 里不会同步到其他服务器。工作室生成页输入场景描述、选择模型即可生成顶部导航可切换 14 个不同工作室核心功能讲解这一节按你实际使用时的任务拆解功能从生成到精修每个功能先说适用场景再说具体操作。从一句话生成视频视频工作室是项目的主角采用双模式自动切换不上传图片时展示 40 个文生视频模型Kling、Sora、Veo、Runway 等上传一张起始帧图片后自动切换到 60 个图生视频模型。操作上就是输入提示词、选择画幅比例和时长、点生成模型列表会随你有没有传图自动变不用自己研究哪个模型能吃图片。核心实现在 src/components/VideoStudio.js。用文字和参考图生成或精修图像图像工作室同样是双模式默认 50 个文生图模型上传参考图后切换到 55 个图生图模型。两个细节比较实用一是支持的模型最多一次喂 14 张参考图勾选顺序就是发送给模型的顺序适合做多角色合成或风格迁移二是所有上传过的图都存进本地上传历史下次用到同一个角色或素材直接从历史面板点选不用重复上传。图像生成页选定模型、输入场景描述生成完成后可一键下载原图让人物口型跟着音频动适合配音、多语言本地化和数字人场景。唇形同步工作室有 9 个专用模型、两种输入模式一种是「人像图片 音频 → 说话视频」另一种是「已有视频 音频 → 口型同步视频」。流程固定选模式、传图或视频、传音频可再写一句提示词引导动作风格然后生成。任务列表单独保存页面刷新后未完成的生成会自动接上。实现在 src/components/LipSyncStudio.js。用相机参数拍出专业电影感电影工作室把相机语言翻译成了生成参数机身从 70mm 胶片到 8K 数字电影机、11 种镜头变形、微距、移轴等、焦距8mm 超广角到 85mm 特写人像、光圈f/1.4 浅景深到 f/11 深焦都可选。选完之后系统会自动把这些参数转成提示词修饰语拼进请求里你不需要自己背「电影感提示词」怎么写。Cinema Studio 中创意移轴镜头选项的示例图共提供 11 种镜头风格进阶与深挖这一节覆盖三件事在自己机器上跑模型、常见问题的排查、以及接入自己的系统。配置本地推理省成本又保隐私本地推理只在桌面应用里可用内置两个独立引擎。一个是捆绑的 sd.cpp直接跑在本机支持 Apple Silicon 的 Metal GPU 以及 Linux/Windows 上的 CUDA、Vulkan、ROCm模型列表有 Z-Image Turbo、SDXL、SD 1.5 系列等全是图像模型另一个是 Wan2GP需要你在有 CUDA/ROCm GPU 的机器上自己跑一个 Gradio 服务器桌面应用通过网络发请求——这意味着 Mac 用户也能远程借用局域网里一台带 NVIDIA/AMD 显卡的机器跑 Wan 2.2、Hunyuan、LTX 等视频模型和 Flux 等大图像模型。两个引擎都在「设置 → 本地模型」里配置一键装引擎、下载模型生成时点 Local 开关就能用全程不需要 API 密钥。硬件上注意跑 Z-Image 建议 16GB 内存8GB 的 Mac 上已知会把系统卡死这类机器请改用 SD 1.5 模型。常见坑与解决网页版启动报「Couldnt find a pages directory」说明没在仓库根目录运行或子模块缺失。确认所在目录里有 app/ 和 next.config.mjs然后重跑 npm run setup 即可。macOS 首次打开被拦截不是中病毒应用只是未做公证。在「系统设置 → 隐私与安全性」点「仍要打开」只需要做一次。Ubuntu 24.04 上 AppImage 无响应或直接闪退新内核的 AppArmor 策略限制了 Chromium 沙箱。直接改用 .deb 包安装时会自动装好对应的 AppArmor 配置。本地生成慢得反常Apple Silicon 上 SD 1.5 正常速度约 1–2 秒一步如果到了 10 秒左右说明引擎回退到了 CPU。去「设置 → 本地模型」重装一次引擎再验证。云端生成失败或超时先确认网络与 API 密钥填的是密钥值而不是密钥名称然后降低分辨率或换一个更轻的模型再试。用 API 接入自己的模型与工作流应用与 Muapi 之间是一个两步协议第一步 POST 到模型端点提交任务第二步轮询结果端点直到状态变为完成密钥走 x-api-key 请求头。客户端实现见 src/lib/muapi.js想接自己的后端或做自动化批处理照这个模式写就行。工作流工作室本质上是这套 API 的可视化版本拖拽节点编辑器把图像、视频、音频模型连成流水线有现成模板可以套用跑好的流程也能保存复用而且每个流程本身都可以通过 API 调用方便嵌进你自己的产品里底层工作流引擎是独立的开源包可以直接搬到其他项目中使用。全部 400 模型的清单就定义在一个文件里packages/studio/src/models.js新增模型或改界面都比想象中简单。如果受够了商业平台的订阅费和提示词拦截现在就可以 clone 仓库跑起来先试着让一句提示词变成第一条视频。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考