Duix.Avatar本地部署实战:10秒视频克隆你的数字分身,离线生成口播视频

发布时间:2026/9/11 8:54:40
Duix.Avatar本地部署实战:10秒视频克隆你的数字分身,离线生成口播视频 Duix.Avatar本地部署实战10秒视频克隆你的数字分身离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想在自己电脑上做口播视频又不想把素材上传到第三方云端Duix.Avatar 是一款完全开源的 AI 数字人工具集支持本地部署用一段 10 秒左右带人声的视频克隆出你的数字分身之后输入文案或喂入音频即可离线生成带口型的口播视频。本文带你从零走到产出第一条视频。 开始前的自检本地数字人部署需要准备什么结论所有算力都在本地跑NVIDIA 显卡和驱动是唯一的硬门槛其余主要是空间和 Docker 环境。逐项对照检查项要求级别NVIDIA 显卡 驱动nvidia-smi能正常输出显卡信息必须内存32G 及以上必须磁盘空间WindowsC 盘 100G镜像约 70G、D 盘 30G数据Linux空闲 100G必须系统Windows 10 19042.1526 或更高或 Ubuntu 22.04 Desktop必须DockerWindows 用 Docker DesktopWSL 后端Linux 用 docker.io docker-compose必须CPU第 13 代 i5-13400F 或更高推荐显卡型号官方以 RTX 4070 为基准50 系显卡有单独配置推荐显存方面官方未给硬性下限README 共创作品中社区有 8G 显存可用的分享按你的显存大小预留即可。️ 部署实战从拉镜像到服务启动主线只有四条命令结论整个服务端就是克隆代码 → 装 Docker → 一条命令拉起剩下的是等待下载。克隆项目源码。在任意你习惯的目录执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar装 Docker。Windows 上先跑wsl --install网络不稳就多试几次安装时会让你设置用户名密码记下来再执行wsl --update然后安装 Docker Desktop 并运行首次启动接受协议、跳过登录即可。Linux 上三行装完sudo apt update sudo apt install docker.io sudo apt install docker-compose一条命令拉起服务cd Duix-Avatar/deploy docker-compose up -d按需求换配置文件只要视频合成服务用docker-compose -f docker-compose-lite.yml up -dUbuntu 用docker-compose -f docker-compose-linux.yml up -d50 系显卡用docker-compose -f docker-compose-5090.yml up -d。四套配置都在 deploy/ 目录。成功的样子首次拉镜像约需半小时、下载约 70G 流量建议连 WiFi。完成后打开 Docker Desktop应看到三个状态为 Running 的容器duix-avatar-tts语音合成端口 18180、duix-avatar-asr语音识别端口 10095、duix-avatar-gen-video视频生成端口 8383。lite 版只有 gen-video 一个容器。如果你的 C 盘不足 100G装完 Docker 后到 Settings → Resources → Advanced用 Browse 把 Disk image location 改到空间充足的磁盘装客户端。Windows 下载官方发布包Duix.Avatar-x.x.x-setup.exe双击安装Ubuntu 下载 AppImage 双击运行root 用户进桌面跑不起来时改用终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。启动后接受用户协议你会看到这张界面左侧紫色卡片是 Create VideoAI 视频生成右侧蓝色卡片是 Create Avatar创建数字人下方是 My Works / My Avatars 两个列表 跑通第一次生成三个动作出第一条口播视频最短端到端路径是建分身 → 输文案 → 出视频全程不需要联网。点 Create Avatar上传一段 10 秒左右、有人声说话的视频——声音会同时被用来做语音克隆。等系统完成人脸特征提取与声音训练后My Avatars 标签页会出现这个以你命名的数字分身。点 Create Video选中分身粘贴文案支持中、英、日、韩、法、德、阿、西 8 种语言选好语音设置后点生成。完成后在 My Works 里点开作品卡片即可播放和下载。所有中间产物与成片都落在本地Windows 在D:\duix_avatar_data\Linux 在~/duix_avatar_data\。 功能深潜按你想做出什么走想要一个能替你出镜的数字分身需要什么素材一段 10 秒视频人脸清晰、有你自己说话的声音。怎么操作Create Avatar → 上传视频 → 等训练完成。会得到什么一个长你样子、用你声音说话的 AI 分身可保存多个分身并在后续生成时切换。想拿一段文案直接出口播片需要什么素材建好的分身模型 一段文字。怎么操作Create Video → 选分身 → 粘贴文案 → 点生成。会得到什么系统先用你的克隆音色合成语音再自动驱动口型输出口型同步的口播视频。想用手头现成的音频驱动数字人需要什么素材分身模型 一个音频文件自己录音或已有旁白。怎么操作在 Create Video 流程中走音频驱动选择音频文件系统会分析节奏和语调自动对齐口型。会得到什么与音频严格同步的成片适合旁白已经录好的场景。想把数字人接进自己的业务Docker 启动后三个服务在本地端口全部暴露18180 管语音合成与克隆训练、10095 管语音识别、8383 管视频合成与进度查询均可用 HTTP 调用。接口实现可对照 src/main/service/model.js、src/main/service/video.js 与 src/main/service/voice.js 三个文件一次读完即可对接。 避坑指南最常卡住的五个地方docker-compose up -d拉镜像超时、报 connection timeout → 先确认网络能否直连 Docker Hub不行就打开 Docker Desktop 的 Settings → Docker Engine在 JSON 里加registry-mirrors配国内镜像源可用清单见 doc/常见问题.mdApply restart 后重试容器起不来、反复重启 → 先跑nvidia-smi确认驱动正常 → 没装驱动就先装 NVIDIA 驱动Linux 还要补 NVIDIA Container Toolkit步骤见 README_zh.md注意本项目没有 NVIDIA 显卡三个服务根本启动不了这不是配置问题。创建分身被拒、报错提示素材不合格 → 先查视频里有没有声音 → 无声视频无法做声音克隆重录一段带人声的 10 秒片段再上传。定制形象时日志出现 Connection refused → 先查duix-avatar-asr容器状态 → 该服务启动较慢服务端起来后等几分钟再操作即可如果机器内存只有 16GASR 可能直接起不来只能加内存。客户端连不上服务或生成卡住 → 先确认三个服务是否都 Running、18180/10095/8383 端口没被占用 → 再打开 Docker 里对应容器的 Logs 页点右侧复制图标导出服务日志同时点客户端右上角齿轮选 Open Log 导出客户端日志两边日志一起排查 效果进阶素材清单比参数重要结论分身不像、口播生硬 八成是素材问题先调素材再谈参数。视频素材10 秒左右即可人脸占画面主体光线均匀无背光纯色简洁背景表情自然、有适度头部动作声音素材安静环境、尽量用好的麦克风语速自然、无背景噪音做声音训练的音频放在D:\duix_avatar_data\voice\data关键参数语音合成接口提供 temperature、topP、repetition_penalty 等项详见 README_zh.md 开放 API 一节前者调情感表现、后者抑制重复小幅微调即可不需要死磕手里有 NVIDIA 显卡、又不想把出镜素材交给云端的朋友现在就可以动手clone 仓库、docker-compose up -d半小时后你就会拿到第一条完全由本地生成的 AI 数字人口播视频。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考