Open Generative AI 免费开源AI图像视频生成工作室:400+模型无内容过滤完整上手指南 📅 发布时间:2026/9/4 23:32:38 👁 浏览次数: Open Generative AI 免费开源AI图像视频生成工作室400模型无内容过滤完整上手指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个免费、MIT 许可的开源 AI 创意工作室把图像生成、视频生成、口型同步和电影镜头控制装进同一个界面背后接通 400 多个主流模型Flux、Midjourney、Kling、Sora、Veo并且不做内容过滤、不强制订阅。它适合不想被各家月费平台绑架、想把生成工具跑在自己机器上的创作者也适合想拿源码做二次开发的开发者。整个项目是 Next.js 加 React 的 monorepo核心逻辑集中在共享的 studio 组件库 里。先跑起来三条上线路径按离你最近的方式选一条就行不用三条都试。在线版零安装官方托管版在浏览器里就能用全部工作室无需 Node.js注册免费账号后直接生成且始终跟着最新模型走。桌面版一键安装从 Releases 下载对应平台的安装程序覆盖 macOSApple Silicon 与 Intel 两个包、Windowsx64和 LinuxUbuntu提供 .AppImage / .deb。macOS 首次启动要放行未签名应用Windows 可能弹 SmartScreen 提示点仍要运行即可完整步骤写在 README。源码版想改再说适合要二次开发的人前置只需要 Node.js 18 以上外加一个 MuAPI 访问密钥只用本地模型的话可以先不填。git clone https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run devnpm run setup会一并初始化子模块、装依赖并构建 studio、工作流、Agent 等 workspace 包只做普通npm install是跑不起来的。跑通后本地访问http://localhost:3000想跑桌面壳则改用npm run electron:dev。遇到Couldnt find a pages directory说明没在仓库根目录执行或子模块没拉全重跑一次npm run setup即可。一个入口按输入自动换模型图像工作室和视频工作室共用同一套看输入切模型的机制理解了它后面所有工作室的操作逻辑就通了。图像侧不上传图片、只打文字时系统列出 50 多个文生图模型Flux、Nano Banana 2、Seedream 5.0、Midjourney、GPT-4o 等一旦拖进一张参考图它立刻换成 55 多个图生图模型Flux Kontext、Nano Banana 2 Edit、Seedream 5.0 Edit提示词也变成可选。视频侧同样的触发逻辑——空手打文字走 40 多个文生视频模型Kling、Sora、Veo、Wan、Seedance 2.0、Hailuo、Runway放进一张首帧图则切换成 60 多个图生视频模型Kling I2V、Veo3 I2V、Midjourney I2V、Wan I2V。分辨率、宽高比、时长这些控件不是每个模型都显示只有模型本身支持时才会出现避免你选一个其实不生效的选项。生成的图片视频都能一键原分辨率下载历史结果存在浏览器本地随时回看。参考图一多玩法就不一样部分编辑模型不止吃一张参考图这是它和大多数平台拉开差距的地方。上限由模型决定Nano Banana 2 Edit 顶到 14 张Nano Banana Edit、Flux Kontext Dev、Kling O1 Edit、GPT-4o Edit 各 10 张Vidu Q2 参考图 7 张Flux Kontext Pro/Max 2 张。选中这类模型后上传框会变成多选带序号复选框、批量选择和使用所选确认模型会严格按你勾选的顺序吃图。传过的图都会留在本地上传历史里下次不用重传逻辑在 上传历史 和 上传选择器。让角色开口口型同步的两种喂料口型同步工作室接 9 个专用模型按你手里有什么分成两条路操作都是选模式 → 传素材 → 选分辨率 → 生成。肖像 音频传一张人物肖像加一段音频产出会说话的视频支持 480p、720p、1080p可用 Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 / 2 19B Lipsync。视频 音频给已有视频重配音、换口型走 Sync、LatentSync、Creatify、Veed、Infinite Talk V2V 这些模型。提示词在这里可选用来引导动作风格。结果单独存一份 lipsync 历史页面刷新时未完成的任务会自动续跑核心逻辑在 口型同步组件。像调相机一样调画面电影工作室电影工作室把摄影参数做成了可视化选项你选完它会把参数翻译进提示词产出偏写实的电影感镜头。三组旋钮镜头70 年代电影定焦、旋流散景、复古定焦、经典变形宽银幕、现代锐利定焦等十余种各自带不同的光学性格。焦距8mm 超广角、14mm、24mm、35mm接近人眼、50mm人像、85mm特写从全景到特写全覆盖。光圈f/1.4 浅景深突出主体、f/4 平衡、f/11 前后都清晰的深景深。相机本体也能选从 8K 模块化数码、全画幅电影数码到 70mm 大画幅胶片、S35 影棚数码。下面两张是它模拟的镜头质感参考——一枚 70 年代定焦镜头和一张 f/11 光圈叶片示意。参数控件源码在 电影工作室组件相机控制逻辑在 相机控制。把单次生成接成流水线或搬回家自己跑这两件事都算从新手转进阶的门槛一个决定你怎么组合多个模型一个决定数据到底在哪算。工作流工作室让你不写代码地把多个模型串起来。内置模板、我的工作流、社区分享、拖拽式节点编辑器和一个可交互的 Playground跑完的结果能直接内嵌渲染每条工作流同时也通过 API 可调方便塞进你自己的系统。引擎是独立的 Vibe-Workflow 包单独拿去也能用。本地推理引擎则让你把算力和数据留在本地只在桌面版里可用配置入口统一在设置 → 本地模型。它有两套互相独立的引擎sd.cpp内置打包C 引擎跟着应用装在机器上Apple Silicon 走 Metal 加速Windows/Linux 走 CUDA/Vulkan/ROCm跑 Z-Image Turbo、Dreamshaper 8、Realistic Vision v5.1、SDXL Base 等图像类模型。Wan2GP自备服务器应用只是个 HTTP 客户端真正的 Python PyTorch 推理跑在你自己的 GPU 服务器上需 CUDA/ROCm适合 Flux.1 Dev、Wan 2.2、Qwen Image、Hunyuan Video 这类更大的模型。选引擎按硬件来M 系列芯片优先 sd.cpp 吃 Metal有独立显卡服务器就挂 Wan2GP 把推理甩过去。8GB 内存机器别碰 Z-Image会卡死改用 SD 1.5 系列跑 Z-Image 建议 16GB 起。想给几十 GB 的权重换个盘启动前设OPEN_GENERATIVE_AI_LOCAL_AI_DIR环境变量即可引擎、模型、临时下载都会落到那个目录。相关源码见 本地推理 与 本地模型管理。三套能照着做的组合拳做一条带人声的电影级短片先在电影工作室定好镜头、焦距、光圈拿到一个有电影感的基础画面再用图生图把局部细节修到位最后丢进口型同步让画面里的人物配一段音频开口说话。三步走下来静态提示词变成了会动的成品。把多张参考图融成一张新图选支持多图输入的模型Nano Banana 2 Edit 顶到 14 张挑 3–5 张风格参考按想要的权重顺序勾好填一段内容描述点使用所选。图与图的相对顺序直接决定融合结果顺序不对效果就差一截。给一台 Mac 配好本地出图打开设置 → 本地模型一键装 sd.cpp 引擎下一个 2GB 左右的 SD 1.5 模型如 Dreamshaper 8回到图像工作室点模型旁的 Local 开关选它生成。全程不碰 API key内存不够就别选 Z-Image。常见问题Q它和 Midjourney、Kling 那些闭源平台差在哪核心是三点完全开源MIT 许可可自托管、不做内容过滤不改写提示词、一次选到 400 模型而不是每个平台各买一份。数据也留在本地API key 只存在浏览器 localStorage除发给模型网关外不上传。Q不会写代码能用吗能。在线版和桌面版都是图形界面输入框拖图就能出结果。只有想加模型、改 UI 才需要碰代码而那部分就是往 模型定义 里加一条、再给对应工作室组件补个 UI 选项。Q本地推理要什么配置最低 8GB 内存能跑 SD 1.5 这类轻量模型要跑 Z-Image Turbo 建议 16GB 起。GPU 方面 Apple Silicon 用内置 MetalWindows/Linux 需要 CUDA/Vulkan/ROCmWan2GP 则要求服务器端有 CUDA/ROCm 的 N 卡或 A 卡。Q生成没反应、或提示词像被拦了这个项目本身没有内容过滤和提示词拒绝。若你用的是在线托管版那是网关侧策略本地版遇到没反应多半是引擎没装好或内存不足回退了 CPU——从终端启动应用看控制台日志最快。打开浏览器访问在线版或从 Releases 拉一个桌面安装程序先出一张图试试手感再回头挑想深入的工作室。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考