怎么在自己电脑上部署一个Duix.Avatar数字人?完整避坑指南

怎么在自己电脑上部署一个Duix.Avatar数字人?完整避坑指南 怎么在自己电脑上部署一个Duix.Avatar数字人完整避坑指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar云端 AI数字人工具要排队、按条收费还得先把自己的脸和声音上传到对方服务器。Duix.Avatar 支持数字人本地部署一段约 10 秒的视频克隆形象和声音之后离线做数字人视频生成素材全程不出本机。它是完全开源的视频合成工具包Windows 和 Ubuntu 22.04 都能跑。下面按实际操作顺序从装 Docker 到出第一条口播视频完整走一遍高频报错附排查方法。它到底能干什么先看功能边界再决定要不要装。克隆10 秒视频换一张数字分身上传一段 10 秒左右的视频程序自动分离画面和声音分别用于形象克隆和声音克隆。声音克隆只认人说的话素材必须带声音、且是人在持续说话克隆出的音色会覆盖语调、语速这些细节。驱动文本或音频口型自动对齐生成视频时二选一输入文本由克隆音色合成语音再驱动数字人或直接上传一段音频当驱动源。口型对齐的处理方式类似配音演员对口型——按语音的节奏逐帧调整嘴部动作避免口不对音。文本转语音支持 8 种语言中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语。运行方式本地一条流水线本地部署实际是三个服务组成的一条流水线ASR 服务fun-asr端口 10095负责听TTS 服务fish-speech端口 18180负责说视频合成服务端口 8383负责把声音贴到画面上。三个都跑在自己的显卡上不依赖外网。完整版轻量版运行服务3 个ASR TTS 视频合成1 个仅视频合成声音克隆 / 文本转语音支持不支持适合谁想克隆自己的数字人只想拿现成模型合成视频边界这些它做不了不是实时交互数字人。开源本地版做的是克隆 离线视频合成实时对话要另找方案。内存 16G 可能直接启动不了32G 是硬要求。商用免费但用户量超过 10 万或年营收超 1000 万美元的企业需要签署商业许可协议见 LICENSE。部署前自检⚠️ 有一条不满足就先去补所有算力都在本地没有英伟达显卡或驱动装错了三个服务一个都起不来。英伟达显卡已装驱动nvidia-smi能打印显卡型号和驱动版本内存 32G 及以上README 标注必要16G 可能启动不了硬盘空闲大于 100G 放镜像Windows 用户另需 D 盘空闲大于 30G 存数字人数据系统版本Windows 10 19042.1526 及以上需 WSL2或 Ubuntu 22.04 Desktop内核 6.8.0-52-generic 已验证Docker 与 docker-compose 已安装显卡驱动版本满足要求网络与时间首次拉镜像约 70G网速正常也要半小时左右建议连 WiFiNodejs 18仅自行构建客户端时需要官方推荐配置供对照i5-13400F、32G 内存、RTX 4070、硬盘空闲大于 100G。一步步跑通第 1 步拿到代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar完成标志目录下有 deploy/里面是 4 个 compose 文件docker-compose.ymlWindows 完整版、docker-compose-lite.yml、docker-compose-linux.yml、docker-compose-5090.yml。第 2 步Windows 装 WSL2 和 Docker Desktop终端执行wsl --list --verbose查看是否装过 WSL没装就先执行wsl --install再执行wsl --update从 Docker 官网下载 Windows 版 Docker Desktop按 CPU 架构选安装包装完首次启动接受协议、跳过登录完成标志Docker 托盘图标显示正在运行。C 盘空闲不足 100G 时进 Settings → Resources → Advanced把 Disk image location 改到剩余空间大于 100G 的磁盘第 3 步Ubuntu 装 Docker 和 NVIDIA 运行时docker --version # 已有版本则跳过下面安装 sudo apt update sudo apt install docker.io sudo apt install docker-compose显卡驱动按 NVIDIA 官方文档安装装完执行nvidia-smi验证。再装 Docker 用 GPU 必需的 NVIDIA Container Toolkitdistribution$(. /etc/os-release;echo $ID$VERSION_ID) \ curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list sudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker完成标志nvidia-smi显示显卡信息docker --version有输出。第 4 步启动服务端按机器选一条执行cd deploy docker-compose up -d # Windows 完整版 docker-compose -f docker-compose-linux.yml up -d # Ubuntu docker-compose -f docker-compose-5090.yml up -d # 50 系显卡30/40 系 CUDA 12.8 也可用 docker-compose -f docker-compose-lite.yml up -d # 轻量版首次拉取约 70G 镜像耐心等半小时左右。完成标志Docker 里出现 3 个容器且全部 Runningduix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video轻量版只有duix-avatar-gen-video一个。第 5 步安装客户端Windows到项目 Releases 下载官方构建的安装包双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu双击Duix.Avatar-x.x.x.AppImage直接运行用 root 用户进桌面时双击可能打不开改在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox完成标志主界面加载出来顶部能看到 Create Video 和 Create Avatar 两个入口。第 6 步训练素材怎么录克隆你的数字人点 Create Avatar上传约 10 秒视频要求正面、人在说话、视频带声音声音克隆就靠这段音轨给数字人命名开始训练进度可在客户端查看完成标志新模型出现在 My Avatars 列表里。第 7 步生成第一条数字人视频进入 Create Video选中刚克隆的数字人输入口播文本或上传音频文件开始生成完成后视频进入 My Works完成标志My Works 里视频可播放口型和声音对得上。踩坑急救 统一按现象 → 原因 → 解法排查提问前先走一遍 doc/常见问题.md 里的自查步骤。镜像拉不下来docker-compose up -d 报超时现象报错Get https://registry-1.docker.io/v2/: ... Client.Timeout exceeded while awaiting headers原因Docker Hub 官方源连接不稳定解法Docker Desktop → Settings → Docker Engine在 JSON 里加registry-mirrors镜像源列表后 Apply restart文档里给了一份可用列表或开全局代理后重试克隆形象时报 Connection refused现象服务端日志出现建立funasr连接异常[Errno 111] Connection refused原因ASR 服务启动比容器状态慢服务刚起时还没就绪内存只有 16G 时可能根本起不来解法三个容器显示 Running 后再等几分钟再做克隆操作内存不足升级到 32G新增模特直接报错进不了训练现象上传视频后立刻报错训练没有开始原因素材视频没有声音或没有人说话声音克隆拿不到音轨解法重录素材10 秒内保持人在持续说话服务起不来怎么查现象容器不在 Running 状态或反复重启TTS 服务反复重启可对照项目 Issue #69 处理排查顺序①nvidia-smi确认驱动正常②docker ps确认三个服务 Running③ 点开容器 Logs 标签页找报错行右侧按钮可直接复制日志④ 客户端日志在设置菜单点打开日志打开的是用户目录下main.log解法服务端到/deploy目录重跑docker-compose up -d拉最新版本客户端 pull 最新代码重新 build进阶玩法把数字人接进自己的程序Docker 起来后本地会暴露三个接口都能通过http://127.0.0.1调用声音预处理建模第一步http://127.0.0.1:18180/v1/preprocess_and_tran返回asr_format_audio_url和reference_audio_text记下来给下一步用音频合成http://127.0.0.1:18180/v1/invoke视频合成http://127.0.0.1:8383/easy/submit进度查询http://127.0.0.1:8383/easy/query?code{code}音频合成请求参数示例{ speaker: 任意唯一UUID, text: 要合成的文本, format: wav, topP: 0.7, max_new_tokens: 1024, chunk_length: 100, repetition_penalty: 1.2, temperature: 0.7, need_asr: false, streaming: false, is_fixed_seed: 0, is_norm: 0, reference_audio: 上一步返回的asr_format_audio_url, reference_text: 上一步返回的reference_audio_text }完整字段说明在 README_zh.md 的开放 API章节客户端实际调用逻辑可参考 src/main/service/model.js、src/main/service/voice.js、src/main/service/video.js。数据目录可以改compose 文件里把训练数据和音频约定目录写死了Windows 是d:/duix_avatar_data/...Linux 是~/duix_avatar_data/...磁盘分区不合适时直接改 deploy/ 下对应文件里的 volumes 映射即可。写在最后服务跑通后从一句文本到一条成片口播视频链路完全在自己手里脸和声音也不用出本机。遇到本文没覆盖的问题先看 doc/常见问题.md 的自查步骤和日志获取方法保持三个服务 Running、nvidia-smi正常多数问题都能从容器日志里直接定位。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考