
Duix.Avatar完整教程5步跑通本地AI数字人免费生成数字分身口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款完全在本地运行的开源AI数字人工具上传一段10秒视频即可克隆你的形象和声音输入文案就能产出数字分身口播视频。本文带你走完本地部署数字人的全流程——从装环境到出第一条成片并附配置选择参考。它是什么文本进、视频出的本地数字人Duix.Avatar 是一个开源数字人工具箱部署、推理、成片全部在你自己的电脑里完成不向任何云端上传素材和脚本。使用不产生订阅或按次费用用户量超10万或年营收超1000万美元的企业需签署商业许可以仓库根目录 LICENSE 为准。整个流程不需要编程准备一段你说话的视频 → 系统完成形象与声音克隆 → 输入文案或上传音频 → 得到口型对齐的口播视频。客户端是桌面程序Windows 或 Ubuntu 22.04底层算力由三个 Docker 服务承担。主界面左侧是两个入口Create Video做口播视频和 Create Avatar训练新数字人下方 My Works / My Avatars 分别存放你的成片与训练好的模型。 先跑通5步启动本地AI数字人以 Windows 为主线路讲解Ubuntu 22.04 的分支见最后一步备注。第1步 · 核对硬性条件。需要 Windows 10 19042.1526 及以上、一块装好驱动的 NVIDIA 显卡磁盘方面 D 盘留 30G 以上存数据Docker 镜像需要 100G 左右空间。先用这条命令确认显卡驱动nvidia-smi能打印出显卡型号和驱动版本即可这条命令跑不通后面所有服务都起不来先装驱动。第2步 · 装 WSL 与 Docker。命令行执行wsl --list --verbose wsl --update前者查 WSL 是否已安装后者更新到最新版。然后安装 Docker Desktop首次启动时接受协议、跳过登录。C 盘剩余不足 100G 的话在 Settings → Resources → Advanced 里把磁盘镜像位置挪到更大的盘即下图红框位置避免镜像把 C 盘写满。第3步 · 获取代码。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar第4步 · 启动服务端。进入deploy目录执行docker-compose up -d首次会拉取 asr、tts、gen-video 三个镜像流量约 70G挂 Wi-Fi 等半小时属正常现象。显存或内存吃紧的机器可先用 lite 精简版只起一个合成服务docker-compose -f docker-compose-lite.yml up -d第5步 · 验证并装客户端。用这条命令确认服务状态docker ps三个服务状态都是 Up 即服务端就绪随后安装 Releases 里的客户端安装包并打开即可。若有服务不是 Up点进该容器的 Logs 标签页把末尾报错复制下来对照排查。Ubuntu 22.04 备注先装 Docker 与 NVIDIA Container Toolkit再到deploy目录执行docker-compose -f docker-compose-linux.yml up -d客户端直接运行 AppImage 文件免安装。 它能干什么三个立刻用得到的能力形象克隆Create Avatar场景你要一个长得像本人的数字人用于口播、课程或产品介绍操作录一段 10–15 秒正面视频必须含你在说话光线充足、无遮挡从 Create Avatar 上传产出一个专属数字人模型存入 My Avatars可反复调用声音克隆随形象训练一并完成场景以后做口播不想每次都重新录音操作无需额外步骤——训练模型时上传的视频音轨就是声音样本训练完成即得到你的克隆音色产出输入文本即可合成你声音的音频支持中、英、日、韩、法、德、阿、西 8 种语言文本驱动口播视频Create Video场景一条脚本换一条视频批量生产口播内容操作选已训练的模型输入文案或直接上传一段音频文件产出带你的形象和克隆声音、口型与语音对齐的口播视频生成后进入 My Works客户端右上角设置菜单里可以随时打开日志排查问题配置怎么选三档硬件参考档位CPU内存显卡能跑什么入门lite 精简版i5-12400F 同级16G偏紧RTX 3060 12G单合成服务720p 口播标准官方推荐i5-13400F32GRTX 4070 12G完整三服务1080p训练与合成稳定进阶i7-13700F 及以上64GRTX 4090 24G合成更快适合长视频与批量任务取舍逻辑一句话显存优先、内存次之——三个服务都压在 GPU 上并行跑显存不够就先退回 lite 版内存低于 32G 时 asr 服务可能起不来别省这一项。⚠️ 避坑指南最容易踩的三种情况拉镜像超时docker-compose up -d报 registry-1.docker.io 连接失败现象三个服务全部 Error提示 request canceled / context canceled原因Docker Hub 官方源不稳定解法Docker Desktop → Settings → Docker Engine 配置国内镜像源配置位置见下图红框或开全局代理再重新执行docker-compose up -d服务起不来或客户端提示 Connection refused现象克隆形象时卡住或报错原因NVIDIA 驱动没装好本项目算力全在本地 GPU或服务端刚启动、asr 还在预热解法先nvidia-smi确认驱动确认三服务 Up 后再等几分钟再做形象克隆操作新增模特报错训练完不成现象上传视频后克隆失败或进度卡死原因素材视频没有声音、或不是人在说话这段声音正是声音克隆的样本也可能是画面模糊、光线差解法重录一段 10 秒以上、光线充足的正面说话视频若内存不足 32G先升级硬件再训练更多报错对照与提问模板见 doc/常见问题.md。延伸与行动部署脚本deploy/目录下有 full、lite、5090 显卡版、Linux 版四份 compose 文件按机型选用完整文档安装指南与开放 API模特训练、音频合成、视频合成三个接口说明见 README_zh.md排障手册doc/常见问题.md等docker ps里三个服务都显示 Up你就可以上传第一段 10 秒视频训练出第一个数字分身了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考