
Duix.Avatar本地部署AI数字人10秒视频克隆会说话的数字分身【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款完全开源的AI数字人由 AI 生成、会说话会表情的虚拟形象项目支持本地部署与全程离线运行上传一段10秒左右的视频即可完成数字人克隆复刻外貌与声音再输入文案就能产出口播视频不收订阅费用数据不出本机适合自媒体、教育、企业宣传以及拥有 NVIDIA 显卡的个人用户。 结果先行10秒视频到成片口播视频部署完成前先看清楚这套流程能产出什么对应三个常见场景自媒体口播场景。你只需拍一段10秒的讲话视频系统就能克隆出一个长相相似、声音相近的数字分身。在客户端里粘贴一篇500字左右的资讯文案等待几分钟得到的是一段口型与内容对齐的口播视频。课程预览场景。教研组克隆一次统一的数字教师之后各科老师输入课堂要点文案各自获得标准口播的预告视频不必反复排期补拍。企业公告场景。企业创建一个品牌代言人形象输入通知文案或直接上传录音音频就能输出介绍视频同一形象还可以做多语言版本。与买现成服务相比差异主要在四行维度商业数字人服务Duix.Avatar费用数万元年费或按分钟计费开源免费使用次数不限数据流向视频、音频、文案都上传云端全部留在自己的电脑里可定制性只能用厂商开放的功能源码可改接口可调用硬件无要求需要一台带 NVIDIA 显卡的电脑 动手前检查核对硬件并验证显卡驱动装软件之前先对照四张门槛任何一条不满足三个服务都起不来系统Windows 1019042.1526 或更高版本或 Ubuntu 22.04显卡NVIDIA 显卡RTX 30/40/50 系列均可50 系列要用专用 compose 文件内存32G 及以上16G 容易导致语音识别服务起不来磁盘镜像存放约 100G 空闲空间形象和作品数据另备 30G显卡驱动验证命令在终端里执行这一条nvidia-smi能打印出显卡型号和驱动版本的表格说明驱动就绪提示找不到命令就先补装 NVIDIA 驱动再继续。⚙️ 从零到跑起来WSL、Docker 与服务端六步部署装 WSLWindows 子系统Docker 在 Windows 上运行的底座在 PowerShell 执行wsl --install已装过的机器直接跳过。装 Docker从官网下载 Docker Desktop 的 Windows 安装包并安装首次启动时接受许可协议、跳过登录即可。迁移镜像存储Docker 默认把镜像放在系统盘而本项目要下载约 70G打开 Docker Desktop 的 Settings → Resources → Advanced把 Disk image location 改到另一个磁盘重启 Docker 生效。拉取代码执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar。启动服务端进入仓库的 deploy 目录执行docker-compose up -dUbuntu 用docker-compose -f docker-compose-linux.yml up -d等待约30分钟让三个服务下载并启动完成。装客户端到项目发布页下载对应系统的安装包Windows 双击 exe 安装Ubuntu 直接运行 AppImage 文件。compose 配置文件均在 deploy 目录可按显卡型号选择。 做出第一个数字人素材、克隆到成片备素材。拍一段10–20秒的讲话视频人物正面入镜、面部光线充足、背景干净且视频里必须有清晰的说话声——系统要拿这段声音做声音克隆无声素材必然失败。上传克隆。打开客户端点击 Create Avatar选中视频上传系统自动提取面部特征与声音特征完成数字人克隆全程约几分钟。文案生成视频。在 My Avatars 列表选中刚建好的形象填入口播文案也可以直接上传音频文件点击生成等待几分钟后成片会自动存入 My Works可直接播放或导出。 踩坑速查三个高频问题的修复1. 服务启动报超时错误现象docker-compose up -d打印 request timeout、context canceled。根因本地网络连 Docker Hub 官方源不稳定镜像下载到一半断开。一步解决在 Docker Desktop 的 Docker Engine 配置文件里加入 registry-mirrors 国内镜像源保存重启 Docker再重新执行 compose 命令。2. 新增模特直接报错现象上传视频后创建形象这一步失败。根因视频里没有清晰的真人说话声声音克隆缺少参考样本。一步解决换一段10–20秒、发音清晰的讲话素材重新上传。3. 生成进度卡住不动现象进度条停在某个百分比或日志出现 Connection refused。根因语音识别服务启动慢还没就绪内存偏小时更易发生或音频路径异常需靠日志定位。一步解决服务端启动后先等几分钟再执行克隆用客户端设置里的打开日志查看客户端日志再打开 Docker Desktop 里对应服务的日志面板看具体报错。更多报错类型可查 常见问题文档。 进阶玩法多语言、批量生成、API 自动化多语言文案引擎支持中、英、日、韩、法、德、阿、西 8 种语言切换语言即可出本地化口播内容。批量生成一次提交多个生成任务适合口播内容的批量产出。API 自动化Docker 启动后三个服务在本地开放端口可通过http://127.0.0.1依次调用模特训练、音频合成、视频合成接口调用示例参考 src/main/service/。 它是怎么跑的三个服务与四步数据流三个服务各管一段ASR 语音识别把说话转成文字、TTS 语音合成按文本生成同音色语音、视频生成服务口型对齐与画面合成。数据流四步①上传视频拆成静音视频与音频②ASR 把音频转写成参考文本③TTS 按输入文案合成同音色音频④视频服务把音频与画面合成口播视频。 谁适合用四类用户各一行自媒体创作者不用出镜也能稳定产出口播内容同一选题做多语言版本。教育机构用统一数字教师做标准化课程视频省去反复排期拍摄。企业团队品牌数字人长期产出产品介绍与内部通知。个人用户家人纪念影像、个性化祝福视频全程离线不担心隐私。✅ 收尾五步行动清单执行nvidia-smi确认显卡驱动通过验证。按六步完成部署在 Docker Desktop 里确认三个服务均为 Running。拍摄一段10秒、讲话清晰的素材视频。通过 Create Avatar 克隆出第一个数字人形象。输入文案生成第一段口播视频收进 My Works 管理。社区在持续补充实时交互、更丰富表情等方向也欢迎提交部署教程与优化经验参与共创授权条款见 LICENSE。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考