ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

Duix.Avatar 完整上手:免费 AI 数字人克隆与口播视频生成教程

Duix.Avatar 完整上手:免费 AI 数字人克隆与口播视频生成教程 Duix.Avatar 完整上手免费 AI 数字人克隆与口播视频生成教程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是硅基智能开源的 AI 数字人工具支持本地部署和 API 调用两种形态上传一段 10 秒左右的视频即可克隆形象与声音之后输入文案或音频就能离线生成口播视频全程不需要联网。我按 Windows 与 Ubuntu 两条路线实测跑通从装好 Docker 到出第一条视频大约 40 分钟下面把顺序、命令和踩过的坑按我的实际路径列出来。动手前先过一遍硬件与环境清单先说结论没有 NVIDIA 显卡或驱动没装好三个服务起不来后面的步骤都白搭。建议按下面这张表逐项核对系统Windows 10 19042.1526 及以上或 Ubuntu 22.04 Desktop内核 6.8 已验证显卡NVIDIA 显卡加正确驱动以nvidia-smi能输出显卡信息为准内存32G 起16G 可能拉不动 ASR 服务磁盘Windows 下 C 盘放服务镜像需 100G 空闲不够的话装好 Docker 后在 Settings → Resources → Advanced 把 Disk image location 改到别的盘D 盘存数字人与作品数据30G离线部署数字人服务的三步走第一步装好 DockerUbuntu 先装 Docker 与 NVIDIA Container ToolkitDocker 调用 GPU 的必备组件sudo apt update sudo apt install docker.io sudo apt install docker-composeWindows 则先确认 WSL 可用wsl --list --verbose查看没有就wsl --install再wsl --update更新然后按 CPU 架构安装 Docker Desktop首次启动接受协议、跳过登录即可。第二步启动三个服务端进入deploy目录启动没有仓库时先git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatarcd deploy # Windows docker-compose up -d # Ubuntu docker-compose -f docker-compose-linux.yml up -d50 系显卡实测 509030/40 系 cuda12.8 用户也可改用docker-compose -f docker-compose-5090.yml up -d。拉镜像约 30 分钟、流量 70G 左右建议连 WiFi。Docker 里出现 3 个 Running 服务即成功lite 版只起Duix.Avatar-gen-video一个。第三步装客户端Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接运行Duix.Avatar-x.x.x.AppImageroot 用户下要加--no-sandbox参数。第一次跑通10 秒视频克隆数字分身主界面点 Create Avatar上传 10 秒左右、人脸清晰且本人在说话的视频——程序要同时克隆外貌和声音无声视频会直接报错。训练需要几分钟有个容易忽略的点首次克隆前等服务几分钟ASR 冷启动慢急着点会报 Connection refused。模型建好后在 My Avatars 选中它输入文案或上传音频点生成几分钟后口播视频出现在首页作品列表。右上角菜单的 Open Log 可以导出客户端日志排障时常用到。踩坑自救高频故障速查表现象根因操作docker-compose up -d超时、连不上 Docker Hub官方源网络不稳定Docker Engine 配置里加registry-mirrors国内镜像源Apply restart三个服务起不来或反复重启无 NVIDIA 显卡或驱动缺失nvidia-smi验证驱动缺则重装内存确认 32G 起新增模特报错提示视频需含声音上传的是无声视频重拍确保清晰人声定制模特 Connection refusedASR 服务启动慢端口 10095服务端启动后等几分钟再克隆tts 日志刷file not exists音频路径不在约定目录确认音频在duix_avatar_data/voice/data下重启对应服务遇到怪问题按固定顺序自查三个服务是否 Running →nvidia-smi是否正常 → 服务端/deploy重跑docker-compose up -d和客户端是否最新版。仍无果时再看具体服务日志比如 TTS 服务18180 端口的日志面板能直接看到音频处理环节的错误。进阶绕过界面直接调 APIDocker 启动后在本地暴露三个端口TTS 18180、ASR 10095、视频合成 8383。模特训练调http://127.0.0.1:18180/v1/preprocess_and_tran音频合成调/v1/invoke视频合成调http://127.0.0.1:8383/easy/submit进度用easy/query?code轮询。完整参数示例见 src/main/service/model.js、src/main/service/video.js 与 src/main/service/voice.js——客户端本质上是这套 API 的 Electron 封装想批量生成或多语言客户端支持英、日、韩、中、法、德、阿、西 8 种语言照着脚本改最省事。素材拍摄与调参清单时长 10 秒左右人脸清晰、正面、光线均匀说话吐字清楚必须有本人说话声背景音越干净越好数据目录D:\duix_avatar_data与 docker-compose 中的挂载路径要一致改了就同步改客户端支持管理多个模型不同形象分开建避免覆盖典型落地场景内容创作自媒体批量产出无需出镜的口播视频多语言版本一次搞定教育培训用统一数字人讲师产出标准化课程形象与语速可控企业宣传品牌代言数字人做产品介绍与客服口播素材可反复复用收尾日志、FAQ 与社区提问前建议按仓库的提问模板整理信息复现步骤 客户端日志右上 Open Log 导出 服务端日志。服务端日志在 Docker 容器面板的 Logs 页签直接复制带完整堆栈。绝大多数问题在 doc/常见问题.md 有现成答案社区更新频繁先把服务端和客户端都升到最新版再下结论。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表