
Duix.Avatar实测三步跑通本地数字人克隆工具8G显存可用【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款全离线的开源数字人工具上传一段 10 秒视频即可完成形象和声音克隆输入文案就能产出口播视频所有计算都在本机完成适合想批量做口播内容、又不放心素材出机器的人。读完你能拿到一份三步本地部署清单、一张最低配置与方案对比表外加 5 个高频踩坑问题的解法。快速上手三步部署本地 Duix.Avatar 服务先说结论有装好驱动的 N 卡、内存 32G就能一次跑通。整个流程分三步拿代码和客户端clone 仓库即可客户端也可以不自己编译直接下载官方构建的安装包Windows 双击 exe、Ubuntu 双击 AppImage 就能用起服务端deploy目录已经备好 docker-compose 编排文件一条命令拉起全部服务验证使用确认容器处于运行状态打开客户端开始克隆。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d两点提醒首次运行会拉取约 70G 镜像连好 WiFi 耐心等半小时左右启动后看到 asr、tts、gen-video 三个容器都 running服务端就就绪了。只想先跑通最简流程的话用 lite 配置只会启动 1 个视频合成服务镜像下载量也小得多Ubuntu 22.04 用户把命令换成docker-compose -f docker-compose-linux.yml up -d即可。客户端里只有两个核心动作「Create Avatar」上传 10 秒视频克隆形象「Create Video」输入文案生成口播视频流程非常直白。核心能力拆解全离线数字人克隆能干什么形象和声音一次克隆到位做什么提交的那段视频会被拆成两样东西——面部形象和声音模型ASR 基于 FunASR、TTS 基于 Fish-Speech都是本地 Docker 服务。为什么重要克隆是一次性成本之后任意文案都能复用新视频不用再进棚录。一句话效果克隆音色保留了原声的语速和语气旁人听不出是合成的。文本或语音两种驱动方式做什么可以丢一段文案让它自动朗读也可以直接上传录好的音频数字人口型跟着声音走支持中、英、日、韩等 8 种语言。为什么重要不用学剪辑写稿就是全部工作流。一句话效果文案进去口型同步的视频出来。全离线且 API 开放做什么视频采集、模型训练、视频合成全在本机完成全程无网络交互三个服务同时在本机开放了接口TTS 是 18180 端口、视频合成是 8383 端口可以直接在自己的脚本里调用。为什么重要私密素材不出机器开发者也能把它接进自己的流水线。一句话效果数据留在本地接口留给二开。场景实战三类典型用法的前后对比场景原来怎么做现在怎么做结果知识类口播连载约棚、拍摄、剪辑一期耗好几天克隆一次形象输入文案即出片人不用出镜单期制作压到分钟级周更多集产品营销短视频每条脚本单独拍返工成本高同一个数字人换文案、换音色批量产出 30 条以上素材产量和迭代速度明显提升跨语言内容找母语者配音有时还得重拍文本驱动一键切语言最高支持 8 种一个人维护多语言版本社区共创活动里有个用户的原话很实在本来以为要折腾半天才能跑起来结果下午就全流程走完了克隆出来的声音和本人几乎没差别。硬件与性能门槛最低配置与部署方案对比官方推荐配置是 i5-13400F / 32G 内存 / RTX 4070实测下限比这低不少。三种部署方案对照如下项目完整版默认轻量版50 系列版启动命令docker-compose up -ddocker-compose -f docker-compose-lite.yml up -ddocker-compose -f docker-compose-5090.yml up -d服务数3 个asr/tts/合成1 个仅视频合成2 个tts/合成镜像下载量约 70G明显更小介于两者之间显存8G 可用RTX 3060 入门同左RTX 5090 已验证30/40 系列 cuda12.8 也可采用内存32G 起步16G 可能起不来同左同左磁盘WindowsC 盘留 100G 放镜像 D 盘留 30G 存数据同左同左适用完整功能先跑通尝鲜功能不全新卡用户的高性能路线注意 lite 版没有 ASR 服务依赖语音识别的链路走不完整定位就是入门体验正式使用还是上完整版。避坑指南五个高频部署问题与解法1.docker-compose up -d拉镜像失败报 request canceled现象三个容器全部 Error。原因Docker Hub 官方源在国内网络下不稳定。解决配置国内镜像源打开 Docker Desktop 的 Docker Engine 设置在 JSON 里加上 registry-mirrors 列表保存后重启即可。2. 创建模型报 Connection refused现象点「训练模型」连不上服务。原因ASR 服务启动慢或者 16G 内存装不下。解决服务端起来后等几分钟再执行首次克隆内存确实小就升到 32G。3. 新增模特一直失败现象声音克隆报错模型出不来。原因源视频里没有人在说话——程序要从视频里提取你的声音来做克隆。解决换一段 10 秒、口齿清晰、正面光照、背景干净的说话视频即可。4. 服务端起不来报 GPU 相关错误现象容器反复重启或直接启动失败。原因没有 N 卡或驱动没装好本项目算力全在本地没 GPU 一切白搭。解决先跑nvidia-smi能显示显卡信息说明驱动正常否则去英伟达官网按型号装驱动。5. 客户端报错分不清是哪边的问题现象界面上只提示失败看不到细节。原因可能是客户端也可能是三个服务中任意一个。解决客户端用右上角菜单的「Open Log」取日志服务端逐个点开 Docker 容器复制日志两边对着看就能定位断点。规划与社区Roadmap 与参与方式项目迭代很快目前社区比较关注的方向有这几条从离线合成扩展到实时直播驱动让数字人能在直播中直接开口移动端轻量版把数字人从 GPU 机器带向更轻的终端与AI 绘画生态打通虚拟场景也能生成而不只是绿底形象。参与方式开源共创计划在 B 站、抖音、小红书、公众号分享部署教程、优化指南、实战案例内容达到一定热度会获评专属称号和数字勋章盯仓库 Issues问题单每天都在关提问前先翻一翻你的坑大概率已经有人踩过并修掉了进技术交流群扫 README_zh.md 里的群二维码或联系官方邮箱 jamesduix.com。资源导航仓库、文档、讨论入口仓库Duix.Avatarclone 地址已给在「快速上手」一节GitCode 上搜索项目名即可直达完整中文文档含 Windows/Ubuntu 安装、开放 API 说明README_zh.md常见问题与提问前自查步骤doc/常见问题.md部署编排文件full / lite / 5090 / Linux 四套deploy/商用授权条款LICENSE结论就一句机器上有 N 卡和 32G 内存的话别犹豫找个下午跑一遍看效果。下期预告《数字人口播不显僵多段生成与批量导出技巧》。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考