
Duix.Avatar免费开源的AI数字人克隆30分钟本地跑通【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar给一段10秒左右你在说话的视频Duix.Avatar 就能把你的长相和声音都克隆下来之后输入一段文字或上传一个音频文件它会自动合成一段口型对得上的口播视频。这是一个免费开源、完全离线的数字人工具不用写代码所有计算都在你自己机器上完成不经过网络。按下面的步骤走大约30分钟可以完成本地部署。主界面上方两个横幅分别是生成视频和创建数字人下方是 My Works作品与 My Avatars我的数字人两个列表右上角可搜索它解决什么问题10秒视频一个你自己的数字人一句话定位上传视频得到数字人输入文案得到视频。形象声音双克隆一段10秒左右的视频同时提取五官特征和声音特征不需要额外录音文字/音频双驱动输入文案自动转语音或直接上传已有音频驱动口型口型同步合成画面与声音自动对齐输出成品口播视频8种语言界面中、英、日、韩、法、德、阿拉伯、西语在设置里随时切换先跑起来本地部署的环境与步骤环境要求项目要求系统Windows 1019042.1526 或更高或 Ubuntu 22.04显卡NVIDIA 显卡且已装好驱动50系列有专门方案内存32G 及以上必要16G 可能起不来部分服务磁盘WindowsD盘空闲30G、C盘空闲100GUbuntu空闲100G推荐配置i5-13400F / RTX 4070 / 32G内存Windows 用户PowerShell 里执行wsl --list --verbose查 WSL没装过就wsl --install网络问题多试几次再wsl --update更新安装 Docker Desktop首次启动接受协议、跳过登录获取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入项目 deploy 目录启动服务端cd deploy docker-compose up -d等约30分钟镜像下载约70G流量建议连WiFiDocker 里出现三个服务即成功从官方 Releases 下载安装包双击Duix.Avatar-x.x.x-setup.exe装客户端C盘不足100G时装完 Docker 后在 Settings → Resources → Advanced 里把 Disk image location 改到空间大于100G的磁盘Docker Desktop 的 Resources 设置页镜像存储位置可以换到空闲空间大于100G的其他磁盘Ubuntu 22.04 用户安装 Dockersudo apt update sudo apt install docker.io sudo apt install docker-compose安装 NVIDIA 显卡驱动用nvidia-smi能显示显卡信息即成功再安装 NVIDIA Container Toolkit依次执行sudo nvidia-ctk runtime configure --runtimedocker和sudo systemctl restart docker启动服务端cd deploy docker-compose -f docker-compose-linux.yml up -d客户端是.AppImage文件双击即可运行root 用户打不开时执行./Duix.Avatar-x.x.x.AppImage --no-sandbox部署完成后第一件事是打开客户端确认本地服务都活着。首次使用走查从视频克隆到第一条口播视频打开客户端点击蓝色 Create Avatar 横幅 → 上传一段10秒左右的视频人脸清晰、必须有人在说话系统要靠这段声音做声音克隆→ 分析完成后My Avatars 列表出现带名字和时间的模型卡片选中你的数字人输入要说的文案或上传音频文件点击生成 → 任务按队列排队完成的作品自动进入 My WorksMy Works 支持关键词搜索和分页浏览默认每页10条成品视频可直接播放右上角 Setting 菜单Open Log 打开客户端日志Language switch 切换界面语言User Agreement 查看协议右上角 Setting 菜单打开客户端日志、切换界面语言、查看用户协议排查和自定义都在这里卡住了怎么办4个高频问题与解法排查顺序先记住三步三个服务是否都是 Running →nvidia-smi能否看到显卡 → 服务端和客户端是不是最新版。都没问题再看日志服务端日志在容器详情页点右侧复制按钮即可完整导出排查前先整段复制服务日志提问或发帖时直接附日志能少说一半话1. docker-compose up -d 拉镜像超时现象报Get https://registry-1.docker.io/v2/: ... Client.Timeout exceeded原因Docker Hub 官方源连接不稳定解法Docker Desktop 打开 Settings → Docker Engine在 JSON 的registry-mirrors数组里加国内镜像源Apply restartUbuntu 则是改/etc/docker/daemon.json里的registry-mirrors字段2. 三个服务起不来现象Docker 里容器不是全部 Running原因没有 NVIDIA 显卡或没装驱动——本项目算力全部在本地缺 GPU 服务直接启动不了解法nvidia-smi验证驱动50系列显卡用专门方案docker-compose -f docker-compose-5090.yml up -d3. 生成卡住tts 日志报 file not exists现象视频生成进度不动duix-avatar-tts 日志反复出现File not exists原因音频文件路径错误或 asr 服务还没就绪解法重启对应服务再试若日志里是 funasrConnection refused说明 duix-avatar-asr 启动慢服务启动后等几分钟再操作4. 定制形象报 Connection refused现象日志出现建立funasr连接异常[Errno 111] Connection refused原因asr 服务未完成启动解法等几分钟重试内存小于16G时该服务可能根本起不来需要加内存更多问题见 doc/常见问题.md。拆开看三个服务与调用链路服务端是三个 Docker 容器客户端是 Electron Vue 应用结构很薄服务镜像端口职责duix-avatar-asrguiji2025/fun-asr10095语音识别duix-avatar-ttsguiji2025/fish-speech-ziming18180文本转语音duix-avatar-gen-videoguiji2025/duix.avatar8383face2face 视频合成调用链路上传视频拆成静音视频音频 →18180/v1/preprocess_and_tran转写音频并建立声音模型 →18180/v1/invoke合成口播音频 →8383/easy/submit提交视频合成8383/easy/query查进度。所有接口都走http://127.0.0.1本地调用。对应客户端代码在 src/main/service/model.js模特训练、voice.js声音、video.js视频合成。玩出花样进阶技巧与落地场景三个进阶玩法lite 版docker-compose -f docker-compose-lite.yml up -d只起一个 gen-video 服务硬件门槛更低适合先试水API 接入不打开客户端直接调 127.0.0.1 上的三组接口训练/音频合成/视频合成把数字人嵌进自己的业务流程多语言口播界面切到目标语言后生成对应语种内容一个数字人形象跨语言复用落地场景自媒体口播不用本人出镜文案进去、成片出来固定栏目可以保持稳定更新频率培训与企业宣传10秒素材变成数字讲师或品牌代言人多份物料形象与口吻一致不用反复重拍个人纪念把一段10秒视频变成可以开口说话的数字纪念婚礼、生日等场合的个性化祝福遇到问题先自查三个服务 Running、nvidia-smi、版本是否最新、Issues 是否已有解法再翻 doc/常见问题.md 和 README 里的技术交流群二维码社区更新很频繁很多问题新版已经修好了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考