ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Duix.Avatar 虚拟形象视频合成安装指南:从 0 到 1 生成第一条数字人视频

Duix.Avatar 虚拟形象视频合成安装指南:从 0 到 1 生成第一条数字人视频 Duix.Avatar 虚拟形象视频合成安装指南从 0 到 1 生成第一条数字人视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的虚拟形象视频合成工具。用一段 10 秒左右的真人视频克隆你的外貌和声音再通过文字或音频驱动形象生成口播视频。全程本地离线运行数据不出本机无需联网。 装前自检先确认你的机器满足条件这是 Duix.Avatar 安装教程里最省时间的一步。项目最低要求推荐配置操作系统Windows 10 19042.1526 或 Ubuntu 22.04Windows 10/11 64 位显卡NVIDIA 显卡 驱动必需RTX 407012G 显存内存16GB服务可能起不来32GB硬盘数据盘 30G 空闲镜像盘 100G 空闲150G处理器四核13 代 i5-13400F 及以上 本项目所有算力都在本地没有 NVIDIA 显卡或没装好驱动三个后端服务直接起不来装其他的东西都白搭。预装工具清单Git —— 拉取项目源代码Docker —— Windows 用 Docker DesktopUbuntu 用 docker.io docker-compose承载语音识别、语音合成、视频合成三个服务NVIDIA 驱动 —— 装完用nvidia-smi能显示显卡信息才算正常Node.js 18 —— 仅从源码构建客户端时需要用官方安装包可跳过Windows 上 Docker 镜像默认放在 C 盘空间要求大于 100G。如果 C 盘不够在 Docker 设置的 Resources 里把 Disk image location 改到剩余空间大于 100G 的磁盘️ 安装主线第 1 步拉取项目源码目的把源代码和部署文件下载到本地后面所有命令都在这个目录里执行。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar把项目克隆到本地然后进入项目目录。判断点当前目录出现Duix-Avatar文件夹里面有deploy、src、README.md等内容即表示本步完成。项目到手后接着配置运行环境。第 2 步装好 Docker 与显卡驱动目的Docker 承载三个 AI 服务驱动让服务能调用显卡两者缺一不可。Windowswsl --list --verbose检查 WSL 是否已安装没有就先用wsl --install安装再执行wsl --update更新。然后安装 Docker Desktop按 CPU 架构选安装包首次启动接受协议并跳过登录再从 NVIDIA 官网装好显卡驱动用nvidia-smi验证能看到显卡信息就说明驱动正常。Ubuntu 22.04sudo apt update sudo apt install docker.io docker-compose安装 Docker 和 docker-compose。接着安装 NVIDIA 驱动与 NVIDIA Container Toolkit执行sudo nvidia-ctk runtime configure --runtimedocker配置 Docker 的 GPU 运行时而后重启 Docker完整命令序列见 README_zh.md 的 Ubuntu 安装一节。拉取官方镜像源不稳定时在 Docker Desktop 里打开 设置 → Docker Engine在 JSON 里加一段registry-mirrors: [...]再应用并重启判断点docker --version和docker compose version都能正常返回版本号本步完成。环境就绪后启动后端服务。第 3 步启动后端三个服务目的把 ASR语音识别、TTS语音合成、视频合成三个服务跑起来这是数字人怎么部署的核心一步后面客户端全靠它们。cd deploy docker-compose up -d拉取三个镜像并后台启动服务。Ubuntu 用户改用docker-compose -f docker-compose-linux.yml up -d显卡是 50 系列的改用docker-compose-5090.yml。⚠️ 首次启动要下载约 70G 镜像耗时半小时左右。建议连上 Wi-Fi 耐心等待期间不要关机。判断点Docker 里或执行docker-compose ps看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个服务全部 Running即表示本步完成。后端跑起来后最后一步装操作界面。第 4 步安装客户端目的客户端是操作界面负责调用上一步启动的本地服务。方式一官方安装包从项目 releases 页下载Duix.Avatar-x.x.x-setup.exeWindows或Duix.Avatar-x.x.x.AppImageUbuntu双击安装或启动。方式二源码构建需要 Node.js 18npm install npm run build:win安装依赖并构建 Windows 安装包产物在dist目录Ubuntu 把命令换成npm run build:linux。判断点dist目录生成安装包或 exe 已安装到桌面双击能正常打开客户端即表示本步完成。✅ 跑通验证到deploy目录执行docker-compose ps确认三个服务都是 Running。打开客户端。首屏应该是主界面上方有Create Video和Create Avatar两张卡片下方是My Works和My Avatars两个页签用最小输入做一次端到端测试输入点击Create Avatar上传一段 10 秒左右、人物在说话的真人视频必须有声音输出训练成功后形象出现在My Avatars列表再到Create Video选中这个形象输入一句简短文字并生成结论My Works里出现一条带你自己形象和声音的口播视频音画同步就说明整条链路跑通了。⚠️ ASR 服务启动较慢服务起来后请等几分钟再创建形象训练视频没有声音必然失败。 上手速览3 分钟会用Create Avatar创建形象—— 上传 10 秒真人视频克隆外貌与声音 —— 首次制作数字人模型Create Video创建视频—— 选形象、输入文字或上传音频一键生成口播视频 —— 产品介绍、知识讲解等固定文案My Works / My Avatars作品与形象管理—— 查看、搜索、删除已生成内容 —— 日常内容管理设置菜单—— 用户协议、打开日志、中英文界面切换 —— 自查环境与切换语言进阶可玩本地开放 API—— 模型训练、语音合成127.0.0.1:18180、视频合成127.0.0.1:8383均有本地接口参数结构参考 src/main/service/ —— 程序化接入自己的系统Lite 版部署—— 用docker-compose-lite.yml单镜像运行 —— 显存有限时先体验视频合成50 系显卡部署方案——docker-compose-5090.ymlCUDA 12.8 的 30/40 系显卡也能用 —— 新显卡用户多形象管理—— 导入多个数字模特不同场景换用不同形象 —— 多角色内容制作 排障速查现象大概率原因处理动作up -d报registry-1.docker.io连接超时Docker Hub 官方源不稳定Docker Engine 加registry-mirrors后应用并重启服务起不来或秒退缺 NVIDIA 显卡或驱动nvidia-smi验证装好驱动再重启服务新增形象报错、Connection refusedASR 启动慢或视频没有声音启动几分钟后重试确认视频是人在说话镜像下载极慢镜像源失效或网络问题换一个可用镜像源源会过期自行搜最新的tts 服务反复重启内存不足或版本过旧服务端客户端都更新到最新版再试最常用的查状态与查日志命令docker-compose ps docker-compose logs duix-avatar-tts前者看三个服务是否都 Running后者查看指定服务的日志把服务名换成 asr / gen-video 同理。客户端日志在右上角设置 → Open Log服务端日志在 Docker 里点进对应服务打开 Logs 页签直接看三个服务 Running、第一条口播视频到手这次数字人新手入门就算跑通了。接下来可以接本地 API 做程序化接入或先看看常见问题文档更多部署细节与解决办法见 doc/常见问题.md。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表