免费开源AI数字人克隆完整教程:10秒视频做出你的数字分身
免费开源AI数字人克隆完整教程10秒视频做出你的数字分身【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个免费开源的 AI 数字人克隆工具上传一段 10 秒左右的视频就能同时克隆出你的形象和声音之后输入文案或上传音频即可驱动这个数字人说话自动合成口播视频。它适合不想出镜的自媒体创作者、需要批量产课的老师以及想低成本搭建数字人内容的企业用户。录口播视频最耗时的不是念稿而是反复返工——光线、妆发、机位稍有变化就要重来。Duix.Avatar 的思路是反过来先把你的形象和声音一次性存档之后的每一条新内容都交给这个数字人替你念。Duix.Avatar 是什么完全开源可商用代码全部开放个人可全球免费商用只有用户量超 10 万或年营收超 1000 万美元的企业才需要签商业许可协议。全离线运行形象、声音数据都在本地处理不经过任何网络传输。10 秒视频完成克隆外貌与声音特征一次提取之后反复使用。Docker 一键部署一条命令拉起 3 个服务约 30 分钟下载完成。部署前先做这3项硬件自检系统Windows 1019042.1526 及以上或 Ubuntu 22.04 Desktop显卡NVIDIA 显卡并正确安装驱动必要条件没有它 3 个服务起不来内存32GB 及以上必要硬盘Windows 需要 C 盘 100GB 以上存镜像、D 盘 30GB 以上存数据Ubuntu 需要 100GB 空闲空间装好驱动后运行nvidia-smi能打印出显卡信息说明环境就绪装 Docker 前用docker --version检查已有版本就跳过安装。30分钟完成本地部署Windows 与 Linux 两条路径整体流程是三步装好 Docker → 在deploy目录启动服务端 → 安装客户端。服务端有 3 个容器TTS语音合成、ASR语音识别、视频合成下载约 70GB 流量速度取决于网速。Windows10 及以上装好 WSL 和 Docker DesktopPowerShell 里wsl --install安装 WSLwsl --update更新再到 Docker 官网下载 Docker Desktop 安装。标志Docker Desktop 图标能正常启动。克隆仓库后进入deploy目录执行docker-compose up -d。约 30 分钟后在 Docker Desktop 的容器列表看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个服务全部 Running。Ubuntu 22.04依次执行sudo apt install docker.io和sudo apt install docker-compose再按官方文档装好 NVIDIA 驱动与 NVIDIA Container Toolkit。标志nvidia-smi正常输出、Docker 服务可用。在deploy目录执行docker-compose -f docker-compose-linux.yml up -d。用docker ps确认三个服务 Running。最后从 Releases 下载客户端Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接运行Duix.Avatar-x.x.x.AppImageroot 用户桌面运行不了时加--no-sandbox参数。10秒视频做出数字人首次使用的最小流程输入点主界面右上角 Create Avatar上传一段 10 秒左右的视频。要求只有一条但很关键——画面里的人要对着镜头说话程序靠这段声音做声音克隆。等待系统先用 ffmpeg 把视频转码为 H264、分离出音频再依次走 ASR 和声音训练几分钟内完成视显卡性能而定。标志My Avatars 列表里出现这个新模特。产出点 Create Video选中刚创建的模特输入文案或上传音频提交后系统排队合成。标志My Works 里出现新视频点击即可播放、保存。踩坑速查4个高频问题的现象与解法现象执行docker-compose up -d后三个服务报registry-1.docker.io连接超时。原因Docker Hub 官方源网络不稳定。解法在 Docker 的 daemon 配置里加registry-mirrors国内镜像源再重新启动 Docker仓库 deploy/ 目录下按平台选择对应的 compose 文件重新拉起。现象新增模特时报错日志提示File does not exist或训练直接失败。原因上传的视频里没有说话声。解法换一段真人对镜说话的素材重新上传视频必须有清晰人声。现象点克隆形象时报Connection refused。原因ASR 服务启动比另外两个慢提前调用被拒绝16GB 内存的机器甚至可能直接起不来。解法服务端全部 Running 后等几分钟再操作并确保内存达到 32GB 门槛。现象Ubuntu 下双击 AppImage 没反应。原因root 用户进入桌面时沙箱受限。解法终端里执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。更多排查细节和日志查看入口见 doc/常见问题.md。进阶玩法本地API、lite版与8语言界面开放 APIDocker 启动后本地127.0.0.1上暴露了模特训练、音频合成、视频合成三组接口具体调用方式可以看客户端主进程的 src/main/service/model.js、src/main/service/video.js、src/main/service/voice.js。做公众号矩阵批量口播、或把数字人能力嵌进自己的业务系统时直接调接口比自己操作界面省事得多。lite 轻量版显存吃紧的机器在deploy目录执行docker-compose -f docker-compose-lite.yml up -d只启动视频合成 1 个服务先把核心跑通。多语言 多模型界面支持英语、日语、韩语、中文、法语、德语、阿拉伯语、西班牙语 8 种语言右上角可切换My Avatars 支持保存多个模特不同口播场景换形象不需要重新克隆。从 10 秒视频到一条口播成片Duix.Avatar 把整个流程做成了纯离线的免费方案数据不出本机。按本文的部署步骤跑通 3 个服务后上传你的第一段 10 秒视频今天就能拥有第一个数字分身。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考