ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Duix.Avatar 数字人本地部署完整指南:10秒视频克隆形象,离线生成口播视频

Duix.Avatar 数字人本地部署完整指南:10秒视频克隆形象,离线生成口播视频 Duix.Avatar 数字人本地部署完整指南10秒视频克隆形象离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款支持本地部署和 API 调用的开源 AI 数字人虚拟人工具上传一段约 10 秒的真人视频即可克隆形象与声音之后输入文案或音频就能驱动数字人嘴型离线生成口播视频。适合想自产数字人视频、又不想把素材上传到云端的独立创作者与中小团队。全程算力都在本机Windows 与 Ubuntu 22.04 都支持。三分钟看懂Duix.Avatar 能做什么先一句话讲清本质它把「克隆」和「驱动」拆成三段流水线——ASR 服务fun-asr把参考视频里的声音转成文本做声音特征TTS 服务fish-speech用你的声音把新文案读出来视频合成服务face2face再把音频贴到克隆形象上输出口型匹配的视频。能力说明✅ 形象克隆上传一段约 10 秒、人在说话的真人视频✅ 声音克隆同一段视频里的声音即作为克隆样本无需单独录音✅ 文字驱动输入文案TTS 服务自动合成语音并驱动嘴型✅ 音频驱动也可直接上传现成音频生成视频✅ 全离线服务端三个 Docker 容器 桌面客户端数据不出本机✅ 多语言文案支持中、英、日、韩、法、德、阿、西八种语言❌ 不做无 NVIDIA 显卡无法运行三个服务都依赖 GPU❌ 不做暂不支持 Windows 10 19042.1526 以下系统及未经测试的 Linux 发行版客户端是一个 Electron 桌面应用源码在 src/renderer/src/桌面端调用的模型训练、视频合成、音频合成接口分别封装在 src/main/service/model.js、src/main/service/video.js、src/main/service/voice.js想写脚本批量调用可以直接参考这三个文件。部署前检查什么电脑能跑官方推荐配置如下⚠️ 最硬性的两条是必须有 NVIDIA 显卡且装好驱动没有它三个服务根本起不来、内存 32G 起步官方在常见问题中明确提示 16G 内存可能启动不了 ASR 服务。项目最低要求官方推荐显卡NVIDIA 独显 正确安装的驱动RTX 4070内存32G 以上16G 可能起不来 ASR 服务32GCPU四核以上i5-13400F 级别磁盘WindowsC 盘 100G存镜像 D 盘 30G存数据Ubuntu空闲 100G同左系统Windows 10 19042.1526 / Ubuntu 22.04 Desktop已验证同左一句话结论带 NVIDIA 显卡、32G 内存的 Windows 10/11 或 Ubuntu 22.04 电脑就能跑没有 N 卡或内存只有 16G 的机器不建议折腾。从零上手Windows 部署四步走第 1 步装好 WSL 与 Docker DesktopWindows 上 Docker 依赖 WSL2 后端。先执行wsl --list --verbose你应看到什么如果列表里有 WSL 发行版说明已安装跳过安装否则执行wsl --install装完再用wsl --update更新一次最后安装 Docker Desktop。首次启动 Docker Desktop 后左下角状态栏显示 Engine running 即为成功。第 2 步规划 Docker 镜像存储位置镜像下载约 70G默认存放在 C 盘。如果 C 盘空闲不足 100G打开 Docker Desktop → Settings → Resources → Advanced用 Browse 把 Disk image location 改到空间充足的磁盘。第 3 步拉取并启动三个服务端容器进入仓库的deploy目录执行cd deploy docker-compose up -d你应看到什么首次运行会拉取三个镜像耗时约半小时取决于网速之后 Docker 中出现duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个 Running 状态的服务表示服务端就绪。⚠️ 下载消耗约 70G 流量建议连 WiFi。第 4 步安装客户端从官方 Releases 下载对应系统版本的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接运行Duix.Avatar-x.x.x.AppImage。你应看到什么客户端打开后就是上文的界面左侧进入「My Avatars」上传一段约 10 秒、人物正面说话的视频完成克隆再进入「Create Video」输入文案生成视频。如果从源码开发运行则在仓库根目录执行npm install看到 added xxx packages 即成功再npm run dev启动开发模式。Ubuntu 服务端流程更简单apt安装 Docker 与 NVIDIA Container Toolkit 后执行cd deploy docker-compose -f docker-compose-linux.yml up -d即可详见 README_zh.md 的 Ubuntu22.04 安装章节。进阶调优5 个实用优化策略低显存机器用 lite 版deploy/docker-compose-lite.yml只启动视频合成服务占用更省适合显存紧张的场景。cd deploy docker-compose -f docker-compose-lite.yml up -d你应看到什么Docker 中只有 1 个服务duix-avatar-gen-video。NVIDIA 50 系列显卡换专用镜像RTX 5090 等新卡需使用基于 CUDA 12.8 的镜像compose 文件已备好cd deploy docker-compose -f docker-compose-5090.yml up -d国内网络配镜像加速在 Docker Engine 设置中添加registry-mirrors镜像源能显著降低拉取超时概率配置样例见 doc/常见问题.md。数据目录可自定义默认数据落在D:\duix_avatar_dataWindows或~/duix_avatar_dataLinux三个 compose 文件中的volumes挂载项都支持按机器实际情况修改。版本要双端同步社区更新频繁服务端重新执行docker-compose up -d拉新镜像客户端 pull 代码后重新 build或直接装最新安装包很多问题在新版已修复。排坑手册5 个高频报错的处理方法症状原因解决docker-compose up -d报registry-1.docker.io ... Client.TimeoutDocker Hub 官方源在国内不稳定按上文第 3 条配置 registry-mirrors 镜像源后重启 Docker新增模特报错提示参考音频异常克隆视频必须包含真人说话的声音程序靠它做声音克隆重新上传一段人在说话、有清晰人声的视频克隆形象报[Errno 111] Connection refusedfunasrASR 服务启动慢服务端刚起就发起请求或 16G 内存太小服务没起来等 3 个服务全部 Running 后等几分钟再操作内存不足则无法解决需升级内存三个服务起不来 / 反复重启无 NVIDIA 显卡或驱动未装好执行nvidia-smi能正常输出显卡信息才算装对参考 doc/常见问题.md 自查步骤Ubuntu 下 root 用户双击 AppImage 无反应沙箱权限限制终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox 提问社区前先按 doc/常见问题.md 的自查清单走一遍三个服务是否 Running、nvidia-smi是否通过、客户端服务端是否最新——这三项排掉后大部分问题自然消失。写在最后一句话总结能力一段 10 秒的真人视频换来一个可离线、可批量驱动的数字分身形象、声音、口型全在你自己的机器上完成。你的下一个动作是什么找一段自己说话的视频按上面的四步流程把三个容器拉起来然后生成第一条口播视频——部署过程遇到报错先对照排坑手册查一张表。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表