ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

Duix.Avatar实操教程:10秒视频克隆你的数字分身

Duix.Avatar实操教程:10秒视频克隆你的数字分身 Duix.Avatar实操教程10秒视频克隆你的数字分身【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想拍口播视频又不想出镜外包数字人服务却要好几万Duix.Avatar是一个免费开源的数字人克隆工具完全在本地离线运行只需一段10秒左右的视频就能同时克隆你的形象和声音再输入任意文案即可自动生成口播视频。这篇文章带你从硬件检查一路走到产出第一条数字人视频照着做就能跑通。 环境速查部署前30秒确认硬件够不够项目要求系统Windows 1019042.1526及以上或 Ubuntu 22.04显卡NVIDIA显卡驱动已装好nvidia-smi可查内存32GB及以上磁盘WindowsC盘100G以上、D盘30G以上Ubuntu空闲100G以上依赖Docker含 Docker Desktop 或 docker-compose 数字人本地部署Docker四步启动第1步 确认NVIDIA显卡和驱动就位这个项目所有算力都在本地没有NVIDIA显卡和驱动三个服务起不来。Windows用户可在NVIDIA控制面板确认Ubuntu用户在终端执行nvidia-smi能看到显卡型号和驱动版本这一步就通过了。第2步 安装Docker并验证版本Windows用户先在PowerShell查WSLwsl --list --verbose没装就用wsl --install安装再用wsl --update更新WSL然后从官网安装Docker Desktop首次启动接受协议、跳过登录即可。Ubuntu用户直接终端安装sudo apt update sudo apt install docker.io docker-compose执行docker --version能输出版本号说明Docker已就绪。第3步 克隆项目并启动三个服务git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d第一次拉镜像要等半小时左右、消耗约70G流量建议连WiFi去倒杯水吧。Ubuntu用户改用docker-compose -f docker-compose-linux.yml up -dRTX 50系显卡用户改用docker-compose -f docker-compose-5090.yml up -d。完成后Docker里会出现三个运行中的容器duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video看到它们都显示Running就算成功了。第4步 下载并启动桌面客户端到项目Releases页下载对应系统的客户端安装包Windows双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu用户双击Duix.Avatar-x.x.x.AppImage直接运行无需安装如果双击没反应在终端加--no-sandbox参数启动。客户端启动后进入主界面可以开始创建数字人了。 首次运行完成Duix.Avatar数字人克隆产出第一条口播视频打开客户端界面上有Create Video生成视频和Create Avatar创建数字人两个入口。Duix.Avatar数字人克隆主界面左侧生成视频、右侧创建数字人下方是作品与模型列表点击Create Avatar 上传参考视频10秒左右即可人脸正对镜头且视频里必须有清晰的说话声——系统会同时克隆形象和声音。等待几分钟完成模型训练结束后 My Avatars 列表里会出现你的新数字人。点击Create Video 选中刚创建的模型输入要说的文案也可以上传自己的音频等待生成完成就得到一条口型与声音同步的数字人视频。 原理一句话底层逻辑很像配音先从参考视频里记住你的长相和声音之后你输入新文案时语音服务用你的音色合成声音视频服务再把口型配到原始画面上。三个服务分工明确fun-asr负责音频转文本fish-speech负责声音克隆合成duix.avatar负责口型合成。⚠️ 高频踩坑与具体解法现象docker-compose up -d报request canceled、Client.Timeout连接超时 →原因Docker Hub官方源连接不稳定 →解决在Docker Desktop 的 Settings → Docker Engine 里给registry-mirrors加国内镜像源Apply restart如下图。Docker Desktop 的 Docker Engine 配置中填入国内镜像源地址现象创建新模型失败提示没有可用音频 →原因上传的视频没有声音或画面里的人没有说话 →解决重新上传一段10秒左右、清晰说话的视频。现象训练时报Connection refused→原因duix-avatar-asr 服务启动较慢或内存不足16G可能起不来→解决三个服务都显示Running后等待几分钟再执行克隆内存不足则升级到32G。现象C盘空间不足、镜像下载中断 →原因Docker磁盘镜像默认存放在C盘 →解决在 Docker Desktop Settings → Resources → Advanced 中把 Disk image location 改到剩余空间100G以上的分区Apply restart如下图。Docker Desktop 设置中可修改 Docker 磁盘镜像的存储位置 进阶指路API、Lite版与多语言本地开放API服务端启动后可通过http://127.0.0.1调用模特训练18180端口、音频合成、视频合成8383端口接口参数示例见 src/main/service/model.js、src/main/service/voice.js、src/main/service/video.js。Lite版在 deploy 目录执行docker-compose -f docker-compose-lite.yml up -d只启动视频合成一个服务资源占用更低。多语言界面支持中、英、日、韩、法、德、阿拉伯、西班牙语八种语言在客户端设置里切换。 谁适合用自媒体创作者不出镜也能批量产出日更口播视频省下布景、拍摄和后期剪辑的时间成本。培训教育机构用统一的数字人形象批量生成标准化课程视频不同科目风格保持一致。开发者直接调用本地API把数字人视频能力集成进自己的产品不用自建模型流水线。收尾Duix.Avatar把数字人克隆从外包服务变成了自己电脑就能干的事全离线、可免费使用。部署细节和更多报错处理先看 doc/常见问题.md问题没解决再到项目Issue区提问。下次有人问这视频怎么做的你可以只回一句我自己分身做的。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表