如何在本地免费跑通 AI 数字人:Duix.Avatar 开源分身部署与出片指南

发布时间:2026/9/11 14:58:03
如何在本地免费跑通 AI 数字人:Duix.Avatar 开源分身部署与出片指南 如何在本地免费跑通 AI 数字人Duix.Avatar 开源分身部署与出片指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar拍一条口播视频先纠结文案再纠结光线机位NG 一次就是半天。Duix.Avatar 把这个流程砍掉了开源的 AI 数字人工具用你一段 10 秒视频克隆外貌和声音之后贴文字就能生成口播视频全程跑在本地素材不出电脑。本地数字人适合谁用谁该直接跳过常做口播短视频、课程讲解、产品介绍需要稳定产出画面的人企业或培训场景要反复露出品牌口播又不想把真人素材交出去开发者想给自己的产品接上数字人 API 能力如果你的需求是打开网页、上传素材、一键生成的纯云服务这个工具帮不上忙——它需要你在本地跑一套 Docker 服务且电脑必须有英伟达显卡Duix.Avatar 的三项能力每样都有明确的输入和输出形象克隆一段正面说话的视频变成可反复使用的数字分身输入只要 10 秒左右的视频声音克隆克隆形象时声音一并克隆音色和语调都保留不需要单独再录语音样本文字转视频贴一段脚本自动合成语音、对口型输出成片脚本支持中、英、日、韩等 8 种语言三步串起来就是完整链路先克隆形象声音跟着形象一起生成最后用文字驱动视频。全程不用打开任何剪辑软件。和云端数字人服务最大的差别在于这三件事都发生在你的电脑上素材不上传任何服务器不用订阅也不按分钟计费。模型克隆一次之后后续出片基本零成本想改文案就重新贴一遍文字。本地数字人最低配置要求三档硬件自检表档位CPU内存显卡能做什么最低10 代 i5 或同级16GB6GB 显存RTX 3060720p 训练与合成推荐13 代 i5-13400F 起32GB12GB 显存RTX 40701080p 日常出片高性能i9 级别64GB24GB 显存RTX 4090批量任务、4K 合成两条实操经验内存是硬门槛官方推荐 32GB16GB 的机器三个服务可能都拉不起来英伟达显卡加官方驱动是前提所有算力都在本地没有显卡服务直接起不来。Windows 用户另需预留 D 盘 30G 以上、C 盘 100G 以上空闲空间分别存作品数据和 Docker 镜像。Docker 五步部署跑通本地数字人服务确认 WSL 已就绪wsl --list --verbose wsl --update安装 Docker Desktop下载 Docker Desktop 的 Windows 版正常安装即可首次启动接受协议、跳过登录。C 盘不足 100G 时进 Settings → Resources → Advanced把 Disk image location 用 Browse 挪到空闲 100G 以上的盘。克隆项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar启动三个服务cd deploy docker-compose up -d首次拉镜像约 70G建议连 WiFi 等半小时左右。RTX 50 系显卡如 5090改启动 deploy 目录里带-5090的 compose 文件Ubuntu 22.04 用户则用带-linux的 compose 文件。内存吃紧时可以改用-lite精简版只起视频合成服务。验证服务状态docker psduix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器都是 Up 即成功。最后安装官方桌面客户端releases 里的 exe 安装包下载后双击打开就能看到首页。从 10 秒素材到成片一次口播视频的生产流程准备素材约 5 分钟正面说话视频10 秒左右720p 以上光线亮、人脸居中、背景干净。注意视频里必须有人在说话程序靠这段音频做声音克隆静音素材会直接报错。执行操作约 30 分钟客户端里点 Create Avatar 上传素材等形象训练完成然后进 Create Video选中刚建好的分身把脚本文字贴进去。拿到成品几分钟到几十分钟取决于文案长度合成完成后一条口型对上的口播视频出现在 My Works 里可直接预览和导出。首次全流程大约 40 到 60 分钟。之后每出一条新片就是贴文字 → 等出片两步几分钟到几十分钟一条素材一次准备长期复用。⚠️ ## 部署踩坑速查三个高频卡点拉镜像失败报连接超时 / context canceled→ Docker Hub 官方源不稳定 → 在 Docker Desktop 的 Docker Engine 配置里给 JSON 加 registry-mirrors 国内镜像源Apply restart创建形象报 Connection refused 或训练失败→ asr 服务启动较慢或机器内存不足 → 服务起来后等几分钟再操作仍报错就在 deploy 目录重新执行 docker-compose up -ddocker ps 里有服务没处于 Up→ 英伟达驱动没装或没装好 → 终端执行 nvidia-smi 验证不显示显卡信息就先装官方驱动再重启服务实在定位不了原因在 Docker 里点开对应容器看 Logs找带 ERROR 或 Exception 的行基本能锁定是哪个环节出的问题延伸阅读项目内资源索引deploy/ — 三个服务的 Docker 编排配置doc/常见问题.md — 官方排障自查指南src/main/service/ — 模特训练与视频合成 API 调用源码LICENSE — 许可协议说明收尾服务跑通、分身克隆好之后下一条口播视频就只差一段文字了。项目仓库与桌面客户端安装包见上文五步部署里的 clone 地址。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考