拓冰建站拓冰建站
首页 / 资讯中心 / 正文

如何免费搭建一个能出视频的本地AI数字人?Duix.Avatar实践指南

如何免费搭建一个能出视频的本地AI数字人Duix.Avatar实践指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个完全开源、离线运行的 AI 数字人工具。上传一段约 10 秒的真人视频即可克隆你的形象和声音再输入一段文案就能生成口型对得上的口播视频。它面向不想把素材交给云端的内容创作者、教育者和有集成需求的开发者。一、开始之前认知与适配确认它是什么、适合谁Duix.Avatar 是一套可以跑在自己电脑上的数字人工具链用短视频克隆外貌用声音克隆音色再让文字或音频驱动形象说话。它的全部计算都在本地完成过程不依赖网络。它适合三类人需要批量口播视频的自媒体创作者需要数字替身讲课的教师以及想把数字人能力接进自己产品的开发者。与传统做法的区别维度传统云端做法Duix.Avatar 本地部署数据安全素材、文案都上传第三方平台全程离线数据不出本机费用按分钟或按次计费用得越多越贵一次性搭好环境不限次数使用速度依赖网络带宽和平台排队只取决于自己的显卡定制空间只能用平台提供的模板代码完全开源可改可扩环境自检硬件与系统要求最低配置能跑起来验证流程用✅ NVIDIA 显卡且装好最新驱动没有英伟达显卡三个服务都起不来✅ Windows 10 19042.1526 以上或 Ubuntu 22.04 Desktop— 16GB 内存能试但 asr 服务可能因内存不足启动失败推荐配置稳定出片用✅ CPU第 13 代英特尔酷睿 i5-13400F 或同级别✅ 内存32GB 及以上官方标注为必要项✅ 显卡RTX 4070 级别显存 12GB✅ 磁盘数据盘空闲 30GB 以上存服务镜像的分区空闲 100GB 以上Windows 用户还要确认有独立 D 盘存放数字人和作品数据C 盘空间不足时安装 Docker 后可把镜像存储位置改到其他磁盘。二、开始上手从 0 到第一次产出部署走一遍四步起服务装 Docker。先执行wsl --install再执行wsl --updateWindows 专属然后安装 Docker Desktop首次启动接受协议、跳过登录。确认方式系统托盘出现 Docker 图标命令行执行docker --version能打印版本号。拉取代码。执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar把仓库克隆到本地。确认方式目录里能看到deploy、src两个文件夹。启动服务端。在deploy目录执行docker-compose up -dUbuntu 用户改用docker-compose -f docker-compose-linux.yml up -dRTX 50 系显卡用docker-compose -f docker-compose-5090.yml up -d。首次拉镜像约半小时、耗流量 70GB 左右建议连 WiFi。确认方式docker ps显示三个容器都是 Running——duix-avatar-asr、duix-avatar-tts、duix-avatar-gen-video。拉取一直超时的话进 Docker Engine 设置添加国内镜像源后重启下图红框处。装客户端。到项目发布页下载官方构建包Windows 双击 exe 安装Ubuntu 直接双击 AppImage 运行root 用户启动需加--no-sandbox参数。确认方式客户端首页出现我的数字人和我的作品两个入口。第一次产出从一段 10 秒视频到第一条口播视频目标克隆你自己生成一条 1 分钟自我介绍。备素材。录一段约 10 秒的正面视频光线均匀、本人持续讲话。注意这条视频必须带声音程序要拿这段声音做声音克隆静音视频会直接报错。建数字人。客户端点 Create Avatar上传这条视频。你将看到模型训练完成后My Avatars里多出一条记录带你的头像截图和创建时间。出视频。点 Create Video 选中刚建的数字人输入一段 100 字左右的自我介绍文案提交合成。你将看到合成任务排队并显示进度完成后My Works里多出一条可播放、可下载的作品。验收。播放成片口型跟随语音开合音色接近本人就算跑通了。关键参数速查参数推荐值影响素材视频时长10 秒左右太短声音克隆不准太长训练慢素材分辨率720p 以上分辨率决定面部细节清晰度内存32GB 起低于此值 asr 服务可能起不来视频编码H.264 的 MP4解码更稳减少训练失败并发任务一次一个同时跑多个训练显存压力很大三、上手之后进阶、避坑与生态典型场景落地课程与培训视频老师录一段正面讲解素材训练一次之后每讲新课只需换文案。要点在安静、光线均匀的环境录素材脚本支持中、英、日、韩、法、德、阿拉伯、西八种语言长课程按小节拆文案分批生成。企业宣传与自媒体口播用统一形象批量产出系列内容强化观众记忆。要点不同栏目用不同文案而非不同形象保持一致性系统支持管理多个数字人模型可按岗位各建一个。开发者 API 集成客户端只是前端真正干活的是本地三个服务它们暴露了模特训练、音频合成、视频合成接口分别监听 18180、10095、8383 端口通过 127.0.0.1 调用。样例代码在 src/main/service/可直接参考 model.js、voice.js、video.js 三个文件。高频问题速答docker-compose up -d 拉镜像超时 现象报 request canceled、Client.Timeout 后三个服务全部 Error。 排查官方源不稳定按部署第 3 步的图添加国内镜像源并 Apply restart。新增模特时报错 现象上传视频后训练直接失败。 排查检查素材是否带声音且本人在说话不满足就重录。定制模特报 Connection refused 现象服务端刚起来就点克隆日志里 asr 连接被拒绝。 排查fun-asr 启动较慢等服务完全 Running 后等几分钟再试同时确认内存 32GB 以上。服务起不来或客户端连不上 现象容器状态不是 Running或客户端连不上本地服务。 排查先执行nvidia-smi确认英伟达显卡和驱动正常再回deploy目录重新执行docker-compose up -d更新服务端客户端同步升到最新版。生态资源部署配置都在 deploy/四个 compose 文件分别对应 Windows 完整版、Ubuntu 版、5090 显卡版和 lite 精简版lite 只起视频合成一个服务。官方故障排查文档见 doc/常见问题.md含拉镜像超时、克隆报错等场景的完整截图。授权说明见 LICENSE全球范围内可免费商用用户量超 10 万或年营收超 1000 万美元的企业需另签商业许可。写在最后Duix.Avatar 把过去需要专业团队和六位数的数字人生产线压缩成一次本地部署三个服务跑起来之后形象克隆到成片都不再产生额外费用。按上文走完四步起服务再录一段 10 秒视频你的第一条口播作品今天就能出来。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门