SadTalker 模型部署:从模型下载到跑通的最短路径

SadTalker 模型部署:从模型下载到跑通的最短路径 SadTalker 模型部署从模型下载到跑通的最短路径【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalkerSadTalker 用一张肖像图和一段音频生成说话人脸视频。环境配置中本文只解决两件事把模型文件放到正确位置跑通一次推理。 最短路径5条命令完成环境配置与模型下载克隆仓库拿到全部源码、配置文件和示例输入素材。git clone https://gitcode.com/GitHub_Trending/sa/SadTalker cd SadTalker创建独立的 Python 3.8 环境避免与其他项目依赖冲突。conda create -n sadtalker python3.8 conda activate sadtalker安装匹配 CUDA 的 torch以下命令来自 README 的 CUDA 11.3 环境。pip install torch1.12.1cu113 torchvision0.13.1cu113 torchaudio0.12.1 --extra-index-url https://download.pytorch.org/whl/cu113安装其余 Python 依赖并用 conda 安装 ffmpeg 供视频编码使用。pip install -r requirements.txt conda install ffmpeg运行仓库自带的一键脚本自动把 4 个动画权重和 4 个 GFPGAN 增强权重下到checkpoints/与gfpgan/weights/。bash scripts/download_models.sh脚本因网络中断时改从模型发布页手动下载checkpoints/下的 4 个文件和gfpgan/weights/下的 4 个文件放入对应目录文件名与下方对照表一致。 目录结构核对checkpoints 文件对照表下载完成后按下面目录树逐一核对文件名必须逐字一致否则推理会直接报加载错误。checkpoints/ ├── mapping_00109-model.pth.tar (MappingNet 权重still/全身模式用) ├── mapping_00229-model.pth.tar (MappingNet 权重默认 crop 模式用) ├── SadTalker_V0.0.2_256.safetensors (256 分辨率面部渲染权重默认) └── SadTalker_V0.0.2_512.safetensors (512 分辨率面部渲染权重--size 512 用) gfpgan/ └── weights/ ├── alignment_WFLW_4HG.pth (人脸对齐增强预处理用) ├── detection_Resnet50_Final.pth (人脸检测) ├── GFPGANv1.4.pth (人脸增强模型) └── parsing_parsenet.pth (人脸解析区域分割用)总磁盘占用约 5.5GB。说话人脸视频的源图就是下面这种肖像图可以借此确认示例素材的位置。✅ 验证跑通一条最小推理命令运行下面这条最小命令音频和肖像都用仓库自带的示例文件。python inference.py --driven_audio examples/driven_audio/bus_chinese.wav \ --source_image examples/source_image/full_body_1.png终端最后输出The generated video is named: results/2026_09_11_xx.xx.xx.mp4即表示正常视频在results/目录下生成。高频踩坑终端报ffmpeg is not recognized当前环境未安装 ffmpeg。解法运行conda install ffmpeg。终端报unexpected EOF, expected 237192 more bytes模型文件下载不完整或损坏。解法删掉损坏文件后重跑bash scripts/download_models.sh。GPU 显存不足报错模型和中间特征占显存过多。解法推理前执行export PYTORCH_CUDA_ALLOC_CONFmax_split_size_mb:128。下一步用--size参数对比 256/512 效果更多参数见 docs/best_practice.md。【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考