Duix.Avatar3分钟克隆你的数字人离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款开源的数字人形象克隆工具上传一段十几秒的真人说话视频就能克隆出你的形象和声音再输入文案即可离线生成口播视频。整个过程完全在本地完成素材不用上传到任何云端脚本还支持中、英、日、韩、法、德、阿、西八种语言。它由 Electron 桌面客户端加 Docker 本地服务端组成模型训练、语音合成、视频渲染全部跑在自己的显卡上。和常见的云端数字人 SaaS 比关键区别只有一条你的素材和算力不出本机隐私由自己掌握。硬件上建议准备一张 NVIDIA 显卡、32G 内存官方推荐配置是 i5-13400F RTX 4070Windows 10 和 Ubuntu 22.04 都支持。先装好 Docker再把服务拉起来服务端跑在 Docker 里所以先装 Docker DesktopWindows 上需先装好 WSLUbuntu 装完 Docker 后还要配置 NVIDIA Container Toolkit 才能调用显卡。如果 C 盘腾不出 100G可以在 Docker 设置的 Resources 里把磁盘镜像存储位置换到大盘。然后把仓库克隆到本地git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入deploy目录执行docker-compose up -d镜像体积大、首次会下载约 70G 数据建议连 WiFi 慢慢等。三个服务都显示 Running服务端就就绪了显存只有 8G 的话可以改用docker-compose-lite.yml启动轻量版。客户端有两种拿法下载官方构建的安装包直接装或按仓库说明自己编译Linux 直接双击 AppImage 就能跑。打开后看到主界面就可以开始克隆了。上传10秒视频把形象和声音克隆出来新建模特时上传一段 10 秒左右的说话视频画面稳定、光线充足人正对镜头自然地说话。程序会自动分离出形象和声音形象用于驱动口型声音则被克隆下来反复使用。克隆完成后主页的「My Avatars」里会多出一张数字人卡片以后口播时都用你自己的声音。用文字或音频驱动数字人生成口播视频进入「Create Video」选一个已有数字人然后二选一输入文案八种语言都支持由系统用克隆的声音朗读或直接上传一段音频文件。系统会做口型对齐输出一条口型同步的成品视频保存到自己的作品列表。到这里完整流程就是上传 10 秒视频 → 写一段文案 → 得到成片。熟悉接口调用的话项目还开放了模特训练、音频合成和视频合成的 APIDocker 启动后本地端口就能调用参数示例见 README_zh.md调用逻辑可以参考 src/main/service/。部署和使用中常见的几个问题拉镜像失败、报连接超时Docker Hub 官方源在国内连接不稳定在 Docker Engine 配置里加国内镜像源再试。三个服务起不来本项目所有算力都在本地机器没有 NVIDIA 显卡或驱动没装好时服务无法启动先确认nvidia-smi能正常显示显卡信息。克隆形象时报 Connection refusedASR 服务启动偏慢服务端刚起来时等几分钟再操作内存小于 16G 也可能起不全所有服务。新增模特时报错上传的视频必须带有清晰人声因为声音克隆就取材于这段视频画面里的人得真的在说话。用真人形象克隆的数字人和克隆出的声音对外发布前请确认已取得本人授权项目协议支持免费商用用户量超过 10 万或年营收超 1000 万美元的企业需另行签署商业许可协议。部署或使用中遇到问题欢迎到项目仓库提 Issue 或看看已有讨论社区更新很频繁很多报错在 Issue 列表里已经有现成答案。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
