
HeyGem.ai 本地部署3 条命令跑通离线数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarHeyGem.ai开源名 Duix.Avatar是一个可以完全离线运行的数字人工具你丢进去一段 10 秒左右的自拍视频它能克隆出你的形象和声音之后输入一段文字或传一个音频文件它就吐出一段口型同步的口播视频。适合内容团队做批量口播、个人把素材留在本地不想上传到云端、以及想直接调它的合成接口嵌入自己产品的开发者。三条上手路径容器路一条 compose 命令拉起三个服务服务端就是三个 Docker 容器语音合成fish-speech、语音识别fun-asr、视频合成face2face定义都在 deploy 目录 里。在deploy目录执行cd deploy docker-compose up -d # 标准版拉取约 70G 镜像命令执行后耐心等待半小时起步取决于网速直到docker ps里duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器全部变成 Running拉取前确认 D 盘或 Linux 的挂载目录空闲大于 30G、Docker 数据目录所在盘大于 100G否则挂载的duix_avatar_data会直接写满。50 系显卡路换一个 compose 文件就行RTX 50 系列以及 CUDA 12.8 的 30/40 系需要换一套基于 torch 预览版的镜像把命令里的文件换掉即可cd deploy docker-compose -f docker-compose-5090.yml up -d # 5090 镜像只起 2 个容器你会看到duix-avatar-tts和duix-avatar-gen-video两个容器起起来这个方案里没有独立的 asr 容器语音识别合并进了合成服务。源码路装依赖后本地起客户端客户端是一个 Electron 应用服务端跑好后克隆仓库并启动界面git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai npm install # 需要 Node.js 18 npm run dev # electron-vite 开发模式启动界面起来后先做两件事确认能连上127.0.0.1的三个端口再把客户端指向服务端的地址确认无误。这些连接信息集中在 src/main/config/config.js开发模式下走的是局域网 IP生产构建默认走本机回环指向别的机器改这里就行。能力拆解克隆、合成、出片三步整个链路就三步克隆模特 → 文字变语音 → 语音驱动视频。界面里对应「Create Avatar」和「Create Video」两个入口每一步都有对应的本地 API 可以单独调。克隆模特能做什么从一段约 10 秒的真人说话视频里同时提取外貌和声音生成一个可反复使用的数字人怎么触发界面点「Create Avatar」上传视频或直接 POST127.0.0.1:18180/v1/preprocess_and_tran关键参数reference_audio提取出的音频相对路径、langzh/en 等返回值里的asr_format_audio_url和reference_audio_text要记下来后面合成语音时还要用文字转语音能做什么用克隆出来的声音朗读任意文本产出一段 wav怎么触发POST127.0.0.1:18180/v1/invoke或者界面里直接输入文案关键参数text要朗读的内容、speaker一个保持唯一的 UUID、reference_audio/reference_text上一步克隆的返回值语音驱动视频能做什么把合成好的音频和模特参考视频对齐输出口型同步的口播视频怎么触发POST127.0.0.1:8383/easy/submit再用127.0.0.1:8383/easy/query?codexxx轮询进度关键参数audio_url、video_url、code任务唯一标识查询时回传三个服务各占一个端口职责如下服务本地端口镜像职责duix-avatar-tts18180guiji2025/fish-speech-ziming声音克隆 文字转语音duix-avatar-asr10095guiji2025/fun-asr上传视频的语音识别duix-avatar-gen-video8383guiji2025/duix.avatar口型驱动与视频合成想跳过界面直接集成到自己的产品服务端的调用示例代码就在 src/main/service/video.js 和 src/main/service/voice.js 里照着改即可。调优与排障拉镜像卡在 Docker Hub 超时现象docker-compose up -d报Client.Timeout exceeded while awaiting headers原因官方源连接不稳定70G 的镜像基本拉不完修复给 Docker 配置国内镜像源// Docker Engine 配置中添加 registry-mirrors { registry-mirrors: [ https://docker.m.daocloud.io, https://docker.1ms.run // 源会失效用哪个先 curl 测一下连通性 ] }克隆模特时 asr 报 Connection refused现象新增模特报错服务端日志里建立funasr连接异常[Errno 111] Connection refused原因fun-asr 容器启动慢刚起服务就提交任务16G 内存的机器甚至起不来修复# 等服务完全就绪再克隆观察 asr 容器状态 docker ps docker logs duix-avatar-asr --tail 50 # 出现监听日志再操作克隆报file not exists或提示视频不合规现象提交模特视频后克隆失败日志提示文件不存在或素材无效原因上传的视频没有声音或画面里的人没有说话——声音克隆素材被静默丢弃了修复换一段约 10 秒、单人正面、持续说话的录像重新上传确认duix_avatar_data目录Windows 在 D 盘剩余空间充足更多报错对照可以查 常见问题文档客户端日志在界面右上角 Setting 菜单里打开下一步你可以试试用curl直接打127.0.0.1:8383/easy/query?code你的任务code对比界面轮询和接口轮询拿到的进度差异把 compose 文件从标准版换成 docker-compose-lite.yml只留视频合成服务对比一下磁盘占用和启动耗时拿 30 秒和 3 分钟两段文案各跑一次合成记录 8383 接口的返回耗时感受长文案对显存和时长的影响【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考