Duix.Avatar 部署指南:数字人离线克隆到出片最短路径 📅 发布时间:2026/9/11 13:53:51 👁 浏览次数: Duix.Avatar 部署指南数字人离线克隆到出片最短路径【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar你有一份写好的口播稿但没有摄影棚也不想反复对着镜头重录。Duix.Avatar 就是干这件事的开源数字人工具提交一段约 10 秒的真人视频完成形象和声音克隆之后输入文案或上传音频即可离线合成口型同步的口播视频全程不依赖云端。 项目速览它能做什么Duix.Avatar 由 Duix.com 开源定位是全离线数字人视频合成工具一个 Electron 客户端 三个 Docker 服务端容器模特训练和视频合成能力全部跑在你自己的机器上。核心能力如下克隆形象与声音上传一段带人声的约 10 秒视频自动完成人脸建模和声音克隆驱动虚拟形象出片支持文字转语音、直接上传音频两种驱动方式合成口型同步视频画面与声音对齐输出可直接使用的口播视频管理多个数字人模型客户端里一键导入、切换不同模特开放本地 API模特训练、音频合成、视频合成接口均可通过http://127.0.0.1调用方便接入自己的流水线⚙️ 跑起来之前硬件与软件要求结论先说NVIDIA 独立显卡 32G 内存是硬门槛缺了任何一项服务都起不来。完整要求如下属性要求 / 值操作系统Windows 10 19042.1526 或更高版本或 Ubuntu 22.04显卡NVIDIA 显卡且驱动正确安装必需无 GPU 三个服务无法启动推荐配置i5-13400F / 32G 内存必需/ RTX 4070磁盘空间服务镜像约需 100G 空闲Windows 另建议 D 盘留 30G 存数字人与作品数据软件依赖Docker docker-compose从源码构建客户端需 Node.js 18服务端组成三个 Docker 镜像fun-asr语音识别、fish-speech-ziming语音合成、duix.avatar视频合成首次拉取约 70G 流量、半小时左右建议 Wi-Fi 环境 从零到跑通6 步最小部署路径按顺序执行Windows 和 Ubuntu 通用差异处已标注。拉取代码。仓库地址git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai确认显卡就绪。终端执行nvidia-smi能正常显示显卡信息即可否则先去装好 NVIDIA 驱动。安装 Docker。Windows 先执行wsl --install、再wsl --update然后安装 Docker Desktop若 C 盘空闲不足 100G在 Docker Desktop 的 Settings → Resources → Advanced 中把 Disk image location 改到空间充足的盘再 Apply restart。启动服务端。完整配置跑 deploy/ 目录下的默认编排50 系显卡或 30/40 系 CUDA 12.8改用docker-compose-5090.yml。Ubuntu 用docker-compose-linux.ymlcd deploy docker-compose up -d安装客户端。从官方 Release 下载安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 下载 AppImage 双击启动root 用户需加--no-sandbox参数。验证并出片。看到 asr / tts / gen-video 三个容器均为 Running 即部署成功然后打开客户端上传带人声的约 10 秒视频克隆模特 → 输入文案或上传音频 → 生成口播视频。 适用场景假如你是……假如你是课程讲师先录一段 10 秒左右的样片完成克隆之后每节课只写文案就能出片换主题、换章节都不用再进影棚录制环节被整体跳过。假如你是自媒体作者把一批口播稿批量转成数字人视频项目支持导入多个模型不同栏目可以切换不同的出镜人文案还支持中、英、日、韩等 8 种语言。假如你是开发者可以跳过图形界面直接调用本地 API——音频合成走http://127.0.0.1:18180/v1/invoke视频合成走http://127.0.0.1:8383/easy/submit进度用/easy/query查询把克隆和合成接进自动化流水线参考代码在src/main/service/下的 model.js、video.js、voice.js。 常见卡点排查Q1拉镜像报超时 / Connection 错误Docker Hub 官方源不稳定。打开 Docker Engine 的 daemon 配置Windows 在 Docker Desktop → Settings → Docker EngineLinux 编辑/etc/docker/daemon.json加入registry-mirrors国内镜像源后 Apply restart再重新执行docker-compose up -d。Q2服务起不来或客户端连不上服务端按两步排查先执行nvidia-smi确认显卡和驱动正常本项目全部算力在本地没有 N 卡驱动三个服务必然起不来再看容器状态docker ps里应有三个 Running 的服务缺哪个补哪个。另外客户端和服务端都要保持最新版很多已知问题已在新版修复。Q3定制模特时报 Connection refused这是 ASR 服务启动慢导致的Docker 起来后等几分钟再执行克隆操作。若等了很久仍失败大概率是内存不足——16G 内存机器可能根本拉不起服务建议 32G。Q4出现报错日志去哪找客户端右上角菜单 → Open Log打开 logs 目录里的main.log。获取Duix.Avatar客户端日志菜单Open Log打开main.log服务端在 Docker 里点开对应容器的 Logs 页签选中报错段复制出来。更多问题可先查 doc/常见问题.md。 收尾适合谁不适合谁一句话结论有 NVIDIA 显卡、想做离线数字人口播视频的人适合没有独立显卡、或需要实时互动数字人的不适合开源版做的是离线视频合成实时交互能力在官方平台上提供。资源入口仓库克隆地址见上文第 1 步中文部署文档在 README_zh.md服务端编排文件在 deploy/。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考