Duix.Avatar 免费开源数字人教程:10 秒视频快速克隆你的数字分身

Duix.Avatar 免费开源数字人教程:10 秒视频快速克隆你的数字分身 Duix.Avatar 免费开源数字人教程10 秒视频快速克隆你的数字分身【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想做口播视频却不想自己出镜Duix.Avatar 是一款完全开源的 AI 数字人克隆工具你只需提交一段 10 秒左右的视频它就能克隆你的形象和声音之后输入文案或上传音频即可驱动数字人嘴型自动生成口播视频。它最大的卖点在于全流程本地离线运行素材和音频都不离开你的电脑。无论你是自媒体创作者、培训视频制作者还是想集成数字人接口的开发者这篇教程都能带你从零跑通。 免费、离线、30 分钟上手它凭什么值得你花时间完全免费开源代码全部开放可自由修改扩展支持商用用户量或营收超大型企业需签商业许可协议。全离线运行所有算力在本地完成视频与声音素材不上传隐私自己掌控。部署成本低基于 Docker 容器化拉完镜像、启动服务即可用约半小时跑通。多语言支持界面脚本支持中、英、日、韩、法、德、阿拉伯语、西班牙语共 8 种语言。 从零到跑通30 分钟完成本地部署准备工作清单系统Windows 1019042.1526 或更高或 Ubuntu 22.04显卡NVIDIA 显卡且驱动已正确安装用nvidia-smi能查到显卡即合格内存32GB 及以上必要16G 可能启动不了服务磁盘Windows 需 D 盘空闲 30G 以上、C 盘 100G 以上存服务镜像Ubuntu 需 100G 以上依赖Node.js 18、Docker第一步获取项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar第二步安装 DockerWindows 用户先用wsl --list --verbose查看是否装过 WSL没装执行wsl --install再执行wsl --update更新然后从 Docker 官网下载 Docker Desktop 安装首次启动接受协议、跳过登录。Ubuntu 用户sudo apt update sudo apt install docker.io sudo apt install docker-compose若拉镜像太慢在/etc/docker/daemon.json中配置registry-mirrors国内镜像源。第三步启动服务端# Windows 用户 cd deploy docker-compose up -d # Ubuntu 用户 cd deploy docker-compose -f docker-compose-linux.yml up -d耐心等待半小时左右下载约 70G 流量建议连 WiFi。看到 Docker 中出现三个服务且均为 Running 状态即成功lite 精简版docker-compose -f docker-compose-lite.yml up -d只有一个服务。使用 50 系列显卡则改用docker-compose -f docker-compose-5090.yml up -d。第四步安装客户端从官方 Releases 下载对应系统安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 双击Duix.Avatar-x.x.x.AppImage启动root 用户需加--no-sandbox参数运行。️ 第一次使用从克隆形象到第一条口播视频打开客户端首页有两块入口“创建视频”短视频制作和“快速定制”快速定制模特。第一次先点“快速定制”。上传一段 10 秒左右的视频至少 8 秒必须包含人在说话的声音声音用来做克隆给模特起个名称点“提交定制”。提交后列表显示“训练中”完成后模特会出现在“我的数字模特”里。点击该模特的“做视频”进入编辑页输入视频名称、粘贴文案支持中英文或直接上传音频文件。点击生成后回到“我的作品”状态会经历“排队中 → 正在制作中”完成后即可预览或下载视频。右上角 Setting 菜单可以打开日志、切换界面语言。 素材怎么拍、生成怎么提速实用技巧素材拍摄视频里必须有人在说话且发音清晰这是声音克隆的原料。时长至少 8 秒建议 10 秒左右人脸清晰、正面为佳。生成提速显存紧张时改用 lite 版docker-compose-lite.yml只跑一个服务。镜像下载慢就配好registry-mirrors镜像源再拉取。服务端刚启动后 ASR 服务起来较慢等几分钟再执行克隆操作避免误报。排障思路先确认三个服务都是 Running再用nvidia-smi确认显卡驱动正常。服务端和客户端尽量保持最新版本服务端到 deploy 目录重新执行docker-compose up -d客户端拉代码重新 build。客户端日志与 Docker 服务日志都要看doc/常见问题.md 里附有取日志的位置。 常见问题速查部署与生成排障Docker 镜像拉取失败、服务起不来常见原因Docker Hub 官方源连接不稳定。可操作解法在/etc/docker/daemon.json添加registry-mirrors国内镜像源后重启 Docker仍不行再检查网络环境。克隆模特时报错失败常见原因源视频没有声音或画面里不是人在说话。可操作解法重新录制一段带清晰人声、时长 8 秒以上的视频再提交。定制模特提示 Connection refused常见原因ASR 服务启动较慢没就绪或机器内存偏小如 16G。可操作解法服务端启动后等几分钟再操作内存建议升到 32G 以上。TTS 服务反复重启常见原因服务版本过旧或端口8383、18180、10095被占用。可操作解法重新拉取最新镜像并在 deploy 目录执行docker-compose up -d更新检查本机端口占用。 进阶速览三个服务如何拼出数字人组件方面服务端由三个 Docker 服务构成fun-asrASR端口 10095负责音频转文本fish-speech-zimingTTS端口 18180负责文本合成语音duix.avatar端口 8383负责口型视频合成客户端是 Electron 桌面应用模型与作品数据存在本地 SQLite。数据流一句话概括训练时先调18180/v1/preprocess_and_tran做音频识别生成时先用18180/v1/invoke把文案合成语音再调8383/easy/submit提交视频合成、用8383/easy/query查进度。关键模块可看 src/main/service/model.js模特训练、src/main/service/voice.js语音、src/main/service/video.js视频服务编排见 deploy/docker-compose.yml。 谁会用得上四类典型场景自媒体创作者不出镜也能持续产出口播视频文案驱动即可。教育培训用统一数字人讲师制作标准化课程视频形象稳定。企业宣传产品介绍、客服引导等场景 24 小时复用同一形象。个人用户为家人朋友制作个性化祝福、纪念类短视频。Duix.Avatar 把原本需要高成本制作的数字人视频变成了一台带 NVIDIA 显卡的电脑上就能完成的本地工作流开源协议下你可以自由改造它。现在就可以按上面的步骤跑一遍部署克隆出你的第一个数字分身。遇到卡壳先看 doc/常见问题.md大多数部署和生成问题都能在那里找到答案仍解决不了再去项目 Issues 里搜索或提问社区更新很活跃很多问题在新版本中已经修复。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考