Duix-Avatar本地部署:3条命令跑通,1段10秒视频克隆数字人

Duix-Avatar本地部署:3条命令跑通,1段10秒视频克隆数字人 Duix-Avatar本地部署3条命令跑通1段10秒视频克隆数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想让视频里的真人开口讲稿又不想去棚里反复录Duix-Avatar 是一款免费开源的本地部署数字人工具上传一段10秒左右的说话视频离线克隆形象与声音之后输入文案就能生成口型匹配的口播视频数据全程不出本机。环境要求清单与最快部署命令组件最低要求推荐配置官方建议系统Windows 1019042.1526 及以上/ Ubuntu 22.04同左CPU无明确下限i5-13400F13代内存16GB官方提示可能启动不了32GB 及以上必要显卡英伟达显卡 驱动RTX 4070硬盘D盘 30GB数据、C盘 100GB镜像空闲 100GB 以上 1. 获取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy启动服务端。docker-compose up -d会自动拉取 ASR语音识别、TTS语音合成、视频合成 3 个镜像下载约 70GB 流量网速正常约半小时docker-compose up -d安装客户端下载官方构建的安装包双击安装或装 Node 18 后执行npm run build自行构建。✅ 验证Docker 里 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个服务都是 Running本机 18180、10095、8383 三个端口在监听。打开客户端新建一个模特能成功就算跑通了。Ubuntu 与 50 系显卡的启动命令见下文表格。核心流程拆解从一段视频到一条口播用一段说话视频克隆形象与声音做什么把10秒左右的说话视频变成一个可复用的模特形象声音。 怎么做程序先用 ffmpeg 把视频转成 H.264通用视频编码格式并抽出音轨音轨送 TTS 服务训练声音再把模特视频、音频和声音编号一起存入本地数据库。 关键代码模特创建服务、ffmpeg 音视频处理。把文案变成你的音色做什么输入脚本文字输出用你声音朗读的配音。 怎么做客户端把文本发给 fish-speech 语音合成服务端口 18180以克隆步骤返回的参考音频和转写文本为依据生成 wav 文件。 关键代码TTS 接口封装。音画合成出口播视频做什么把配音和模特视频合到一起得到口型对齐的成片。 怎么做把音频路径与视频路径提交到视频合成服务8383/easy/submit再用任务 code 轮询查询进度。 关键代码视频合成服务、服务地址与数据目录。素材准备规范与不同显卡的参数配置素材规范模特视频约10秒人物正面、说话清晰必须带人声——声音克隆用的就是这段音轨无需手动剪辑程序自动转 H.264、抽音频音轨不足20秒会整体处理不用预先切分数据默认写在D:\duix_avatar_dataWindows该盘预留30GB以上脚本支持8种语言中、英、日、韩、法、德、阿拉伯、西语。不同机器选哪份部署文件档位 / 场景启动命令deploy 目录下说明全功能32GB 内存 RTX 4070 级docker-compose up -d3 个服务识别 合成声音 合成视频只合成视频内存偏小docker-compose -f docker-compose-lite.yml up -d只起视频合成服务配音需自备RTX 50 系如 5090docker-compose -f docker-compose-5090.yml up -d使用 torch 官方预览版Ubuntu 22.04 桌面docker-compose -f docker-compose-linux.yml up -dLinux 部署提示合成容器已默认带 8GB 共享内存与显存碎片控制参数见 docker-compose.yml一般不用动。新手高频报错与排查方法⚠️ 拉镜像报 request canceled / 连接超时Docker Hub 官方源不稳定在 daemon.json 里配置 registry-mirrors 国内镜像源后重启 Docker。⚠️ 新增模特失败模特视频必须有人声且是人在说话程序用这段声音做克隆静音或纯背景音乐的视频会直接报错。⚠️ 克隆形象时报 Connection refusedASR 服务启动慢服务起来后等几分钟再操作内存只有16G时可能根本起不来建议32G。⚠️ 三个服务全起不来先执行nvidia-smi确认显卡与驱动。本项目算力全在本地没有英伟达显卡或驱动装错服务是起不来的。⚠️ C盘空间不够Docker Desktop 设置 → Resources → Advanced把磁盘镜像位置改到剩余100GB的盘。更多报错案例见 常见问题文档。适合谁下一步做什么Duix-Avatar 适合两类人想本地批量产出口播视频、又不想把素材传上云的创作者以及想直接调用 18180/10095/8383 三个本地端口做二次集成的开发者。建议先克隆一个模特、生成一条30秒短片感受效果再对照 src/main/service 里的接口把自己的流程接进去。部署卡住时优先看三个容器的 Logs 日志大部分报错在文档里都有对应解法。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考