如何快速完成AI数字人本地部署:Duix-Avatar三步上手指南 📅 发布时间:2026/9/11 9:21:55 👁 浏览次数: 如何快速完成AI数字人本地部署Duix-Avatar三步上手指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一款真正开源的 AI 数字人工具全程离线运行。提交一段 10 秒左右的视频它就能完成你的形象和声音克隆之后输入文案或上传音频可以直接生成口型匹配的口播视频不用任何云服务所有素材都在你自己电脑上完成。无论你是自媒体创作者还是第一次接触数字人的新手跟着这篇文章就能把本地部署跑起来。Duix-Avatar 能做什么形象声音克隆一段 10 秒视频建出数字分身文案生成输入一段文字自动输出口播视频音频驱动上传音频数字人跟着音频对口型开放本地接口训练和生成都有接口可集成进自己的系统三个核心能力分别跑在三个 Docker 服务里ASR 语音识别、TTS 语音合成、视频生成。文案支持中文、英文、日语、韩语、法语、德语、阿拉伯语、西班牙语八种语言。项目开源免费支持商用所有素材不出本机处理公司内部培训、个人 IP 这类敏感内容时尤其安心。想深入看代码的话视频合成的调用逻辑在 src/main/service/video.js。跑起来之前要看什么项目最低要求推荐配置系统Windows 10 19042.1526 以上或 Ubuntu 22.04Windows 11 / Ubuntu 22.04 LTS显卡英伟达显卡 正确安装的驱动RTX 4070内存16G可能启动失败32G 及以上CPU无硬性要求i5-13400F磁盘WindowsC 盘 100G存镜像、D 盘 30G存数字人数据Ubuntu空闲 100G200G SSD⚠️ 没有英伟达显卡或驱动没装好三个核心服务都起不来——这是唯一的硬性要求部署前先用 nvidia-smi 确认能显示显卡信息。第二个容易踩的坑首次启动要拉取三个 Docker 镜像一共约 70G 流量耗时半小时左右建议连上 WiFi 再执行然后去忙别的。另外 C 盘空间不足 100G 时可以在装完 Docker 后到 Docker Desktop 设置里把镜像存储位置换到空间足够的磁盘。把项目跑起来Duix-Avatar本地部署步骤 步骤1获取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar仓库里主要是客户端真正的算力全在三个 Docker 镜像里。步骤2启动服务cd deploy docker-compose up -d这一条命令会自动拉取镜像并在后台启动三个服务等它下载完就行。如果你还没装 Docker DesktopWindows 上先执行wsl --install装好 WSL 再装 Docker。NVIDIA 50 系列显卡改用docker-compose -f docker-compose-5090.yml up -dUbuntu 用docker-compose -f docker-compose-linux.yml up -d硬件配置有限也可以换 lite 版本只起一个视频生成服务。服务端口和数据目录都写在 deploy/docker-compose.yml 里不清楚某个配置作用时可以翻一下。步骤3确认服务状态打开 Docker Desktop看到 Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video 三个服务都是 Running 状态服务端就算部署完成了。步骤4安装客户端到项目的 Releases 页面下载官方构建包Windows 双击 .exe 安装Ubuntu 双击 .AppImage 直接运行。启动后接受用户协议就可以开始用了。第一次使用从 10 秒视频到第一条数字人视频先准备素材一段 10 秒左右的出镜视频正面朝向镜头光线均匀别逆光人必须在说话且声音清晰——这段音频会被拿去做声音克隆无声视频一定会失败操作就三步启动客户端接受协议首页点Create Avatar上传你的视频训练完成后数字人会出现在My Avatars列表里点Create Video选中刚建好的数字人输入一段文案比如大家好这是我的第一条数字人视频点生成等几分钟到My Works里就能看到成品口型、音色和你写的文案全部对上可以直接预览和下载。同一个形象还能建多个用途讲解、播报各留一个互不干扰。顺带一提客户端生成的素材和模型都存在固定目录里Windows 是 D:\duix_avatar_dataLinux 在用户主目录下这个目录别删。遇到问题先看这里docker-compose up -d 连接失败报 request canceled 或超时Docker Hub 官方源不稳定。在 Docker Engine 设置里给 registry-mirrors 配上国内镜像源点 Apply restart 之后重新执行命令即可。新增模特时报错用来创建模特的视频必须有人说话。程序要从视频里提取声音做声音克隆静音、无音轨或只有背景音的视频都会失败换一段正常说话的素材重来。定制模特报 Connection refusedASR 服务启动比较慢服务端启动后等几分钟再操作克隆。另外如果你的内存只有 16G服务可能根本起不来建议直接上 32G 及以上。NVIDIA 50 系列显卡起不来服务用专用配置docker-compose -f docker-compose-5090.yml up -d30、40 系列显卡配 cuda12.8 也可以用这个方案。更多高频问题在 doc/常见问题.md 里都给了排查步骤建议部署前通读一遍能省不少时间。无论是做课程讲解、短视频口播还是企业物料只要有一张英伟达显卡数字人视频制作这件事你就可以在本地自己完成。第一条数字人视频不会太花时间不妨现在就跑起来试试。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考