
SadTalker 音频驱动人脸动画模型下载与配置从零跑通的完整指南【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker一张图片加一段音频就能让静态肖像开口说话——这就是 SadTalker 的核心玩法。但在看到效果之前多数新手会卡在同一关SadTalker 模型下载与checkpoints 配置。模型文件放错位置、少一个文件命令行只会甩给你一串报错。本文带你走完下完模型能干什么 → 一条命令下全 → 文件放哪 → 失败兜底 → 跑通验证全程照做即可。配置完能拿到什么效果模型文件是 SadTalker 人脸动画流水线的大脑两个预训练 MappingNet 负责特征映射两版面部渲染模型分别对应 256 与 512 分辨率。它们全部就位后你只需要喂一张图和一个 wav就能产出会动的说话头部视频。输入素材的要求并不高一张清晰的单人肖像就够例如项目自带的样例图全身照也能用只要脸部够清楚配好模型后你甚至可以用参考视频来驱动人物动作而不是只靠音频第一步准备代码与基础环境还没有代码的话先克隆仓库git clone https://gitcode.com/GitHub_Trending/sa/SadTalker cd SadTalker接着建一个独立的 Python 3.8 环境并装依赖各平台的细节可看 docs/install.mdconda create -n sadtalker python3.8 conda activate sadtalker pip install -r requirements.txt另外系统里要有ffmpegconda install ffmpeg一条命令搞定否则后面拼接视频会报错。一键下载全部模型文件项目自带下载脚本 scripts/download_models.sh进到项目根目录执行bash scripts/download_models.sh脚本干了两件事建checkpoints/目录下载 4 个核心模型2 个 MappingNet 256/512 两版面部渲染模型建gfpgan/weights/目录下载 4 个人脸增强权重只有加--enhancer gfpgan才用到但建议一并下好。脚本里的下载全部是wget -nc中断后重跑一遍就能续传已完成的文件会自动跳过不用手动处理。模型文件该放哪个目录下载完成后你的项目结构应该是这样checkpoints/ ├── mapping_00109-model.pth.tar ├── mapping_00229-model.pth.tar ├── SadTalker_V0.0.2_256.safetensors └── SadTalker_V0.0.2_512.safetensors gfpgan/weights/ ├── alignment_WFLW_4HG.pth ├── detection_Resnet50_Final.pth ├── GFPGANv1.4.pth └── parsing_parsenet.pth分工说明mapping_00109/mapping_00229-model.pth.tar预训练 MappingNet做潜在特征映射SadTalker_V0.0.2_256.safetensors/SadTalker_V0.0.2_512.safetensors256 与 512 两档分辨率的面部渲染模型按你想要的输出分辨率二选一使用gfpgan/weights/下 4 个文件GFPGAN 增强权重不增强可以不要但体积不大建议补齐。一键下载失败的手动方案网络不通官方源时模型文件可以手动从下面任一渠道取回再按上面目录放好项目 Releases 区发布的模型包项目文档里给出的 Google Drive 完整模型包百度网盘提取码sadt国内网络环境下最稳的选择。手动下载只有一条硬规则文件名和目录层级必须与清单逐字一致。SadTalker 是按固定路径加载模型的手动放完后对着上面的目录结构逐一核对一遍即可。如何确认模型装好了最直接的验证是跑一次完整推理python inference.py --driven_audio examples/driven_audio/chinese_news.wav \ --source_image examples/source_image/people_0.png \ --enhancer gfpgan一路跑完、在结果目录输出 mp4说明核心模型与 gfpgan 权重全部就位 ✅。报错时这样对号入座提示找不到文件文件名或目录层级没对上回查上面的结构提示文件损坏 / unexpected EOF该文件没下完整删掉重新下其他报错直接翻 docs/FAQ.md大部分都有对应条目。常见坑一句话排雷磁盘要留多大全套模型加依赖预留5GB以上空闲版本匹配模型与代码版本要配套别拿旧版模型配最新代码下载中断重跑脚本即可wget -nc会跳过已完成文件跑通后想调效果--expression_scale、--still等参数怎么调看 官方最佳实践。模型就位SadTalker 的 checkpoints 配置就算通关了——接下来换自己的图和音频开始说话吧 【免费下载链接】SadTalker[CVPR 2023] SadTalkerLearning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation项目地址: https://gitcode.com/GitHub_Trending/sa/SadTalker创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考