
30分钟本地部署Duix-Avatar生成第一条AI数字人口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar录一段10秒视频丢进自己的电脑十分钟后得到一条自己说话的视频——这就是Duix-Avatar本地部署之后你能做到的事。这套开源AI数字人工具全程离线完成形象与声音克隆素材和声音数据都锁在自己的电脑里不会上传云端。如果你是个人创作者、自媒体博主或小型内容团队按下面的步骤操作大约半小时就能在自己的机器上产出第一条口播视频。先确认你的电脑跑不跑得动4项硬件逐一过本地部署翻车最常见的原因在硬件上。这个项目把所有算力都放在本地并依赖CUDA加速动手前先对着下表自查一遍配置项要求快速自检方式显卡NVIDIA显卡推荐RTX 4070及以上到NVIDIA官网驱动页核对型号确认该卡支持CUDA内存32GB及以上系统设置里查看已安装的内存CPU第13代英特尔酷睿i5-13400F或更高推荐用CPU-Z查看型号与核心数存储C盘≥100GB、D盘≥30GBUbuntu则130GB空闲文件资源管理器查看各分区可用空间系统Windows 10 19042.1526或更高或Ubuntu 22.04桌面版右键此电脑→属性查看系统版本必须是NVIDIA显卡AMD显卡和核显带不动这三个服务容器这一步不达标就不用往下走了。存储要求主要花在两处Docker镜像文件占C盘约100GB训练出的形象和生成的作品存放在D盘约30GB。空间不够时装完Docker后可以把它的数据目录改到空余更大的磁盘上。备齐WSL和Docker把三个服务拉起来装好WSL与Docker Desktop打开终端执行wsl --list --verbose查看是否已装WSL没有就用wsl --install安装。执行wsl --update更新WSL终端提示更新成功即可。到Docker官网下载Windows版Docker Desktop安装首次启动接受协议并跳过登录。验证标准系统托盘的Docker图标保持Running状态基础环境就绪。获取项目代码并拉取服务镜像git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar本地部署需要三个服务镜像一个负责语音识别fun-asr一个负责语音合成fish-speech-ziming一个负责视频生成duix.avatar。在终端依次拉取docker pull guiji2025/fun-asr docker pull guiji2025/fish-speech-ziming docker pull guiji2025/duix.avatar镜像下载约70GB流量耗时半小时左右建议连WiFi耐心等待。用docker-compose一键启动三个服务服务配置放在仓库的deploy 目录里标准版启动三个服务lite版只启动视频生成服务。cd deploy docker-compose up -d打开Docker Desktop的容器页面验证三个服务都显示Running说明本地数字人服务已经就绪。图1Docker容器日志界面状态区显示Running本地数字人服务全部就绪装好客户端连上本地服务下载官方构建的Windows安装包Ubuntu用户下载AppImage双击即可运行。双击Duix.Avatar-x.x.x-setup.exe完成安装。启动客户端首次运行勾选同意用户协议进入主界面。验证标准主界面顶部有Create Video生成口播视频和Create Avatar克隆形象两个横幅入口下方是My Works和My Avatars两个标签页。图2客户端主界面Create Video与Create Avatar分别是口播视频生成和形象创建入口 一段10秒视频克隆出你的数字形象录制10-15秒的训练视频正面拍摄纯色或绿幕背景光线充足面部清晰、表情自然包含简单的转头动作视频里必须有你在说话的音频程序要从中克隆你的声音建议分辨率720p以上录完存到本地上传素材并启动训练主界面点击Create Avatar上传录好的视频。输入模型名称选择性别与年龄段点击开始训练。等待5-10分钟完成后My Avatars标签页会出现你的形象卡片点开可预览。输入台词生成第一条口播视频用文本驱动生成选中训练好的形象点击Create Video。在文本框输入台词第一次建议50字以内。选择语音风格按需调整语速、语调。点击生成等待3-5分钟成片会自动存进My Works可预览、下载。图3客户端My Works标签页展示已生成的数字人口播视频作品让成片更专业的5个做法绿幕背景拍摄后期可替换任意场景背景口型区域更干净、画面更稳。调面部参数口型区域发虚时可在本地配置文件里提高面部检测置信度、切换到高精度面部特征点只改本地配置文件不动仓库代码。多形象管理不同表情风格微笑、严肃各训练一个模型按视频内容切换数字人定期清理不用的模型释放空间。API批量出片Docker服务启动后视频合成接口暴露在本地127.0.0.1传入音频与视频路径即可提交任务curl -X POST http://127.0.0.1:8383/easy/submit \ -H Content-Type: application/json \ -d {audio_url:D:/duix_avatar_data/audio.wav,video_url:D:/duix_avatar_data/video.mp4,code:task-001,chaofen:0,watermark_switch:0,pn:1}后期精修把导出的视频导进常用剪辑软件加字幕、背景音乐和转场再发布。常见故障、性能调优与求助渠道常见故障速查现象可能原因处理办法三个服务容器起不来Docker未启动或NVIDIA驱动未装先启动Docker装完驱动执行nvidia-smi验证拉镜像缓慢或卡住Docker Hub官方源连接不稳定在Docker配置中设置国内镜像源后重新拉取新建模特时报错训练视频无声或没有人说话重新录一段10-15秒、含清晰人声的视频训练卡住、提示连接被拒内存不足或asr服务尚未启动完成关闭其他程序服务启动后等几分钟再训练客户端连不上服务18180或8383端口被占用检查占用该端口的进程并关闭再重启容器按配置档次参考的性能参数需要按自己的配置调节渲染参数时改本地配置文件即可同样只动本地配置文件不动仓库代码低配i532GBRTX 4070渲染质量medium面部细节等级2批大小1线程数4中配i764GBRTX 4080渲染质量high面部细节等级3批大小2线程数8高配i9128GBRTX 4090渲染质量ultra面部细节等级4批大小4线程数16日志怎么拿、问题去哪问故障没解决时先看日志客户端日志入口在右上角菜单里服务端日志在Docker里打开对应服务复制日志输出。仓库内的常见问题收录了连接失败、克隆报错等典型情况可以对照自查。图4Docker容器日志界面复制日志便于在数字人社区求助时附上接下来你可以试用本地API加脚本做批量出片一次跑多条台词建一套不同形象、不同声音的数字员工库按内容类型切换形象或者把导出的口播视频直接接进你日常使用的剪辑工具打通后期流程。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考