ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Duix.Avatar:10秒视频克隆你的AI数字人分身,完全免费且离线运行

Duix.Avatar:10秒视频克隆你的AI数字人分身,完全免费且离线运行 Duix.Avatar10秒视频克隆你的AI数字人分身完全免费且离线运行【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是硅基智能开源的免费 AI 数字人工具录一段 10 秒左右的视频就能克隆出你的形象和声音之后输入文案或上传音频自动生成口型匹配的口播视频。全程离线跑在本地适合想做短视频、课程、企业宣传又不想把素材上传到任何云端的个人和小团队。比传统数字人省在哪对比项传统 3D 数字人方案Duix.Avatar 开源数字人制作成本数万元起免费开源可全球商用*素材要求棚拍建模周期数周10 秒左右手机视频运行方式云端或专用工作站本地离线数据不出机器驱动方式手动绑定动捕文本/语音直接驱动扩展方式供应商定制本地开放 API可自己集成注意商用基本免费但用户量超过 10 万或年营收 1000 万美元以上的企业需签署商业许可协议。形象 声音一次克隆基于 ASR自动语音识别把说话内容转成文本和 TTS把文字合成语音技术10 秒视频同时完成外貌和声音克隆口型自动对齐画面与声音高度同步唇形同步无需手动调支持 8 种语言脚本中、英、日、韩、法、德、阿、西动手前备好这套配置所有算力都在本机下面这张清单达标再开始项目要求说明系统Windows 10 19042.1526 或 Ubuntu 22.04 Desktop其他 Linux 版本未验证显卡NVIDIA 显卡推荐 RTX 4070 已装好驱动硬性要求没有则服务起不来内存32GB 及以上16GB 可能启动不了硬盘100GB 以上空闲Windows 下 D 盘再留 30GB 存数字人和作品CPU推荐 i5-13400F 级别—Windows 上 Docker 怎么配确认 WSL 是否已装执行wsl --list --verbose有输出即已安装没有就执行wsl --install按提示设置用户名和密码。执行wsl --update把 WSL 更新到最新版出现up to date或版本提示即成功。下载并安装 Docker Desktop首次启动接受协议、跳过登录左下角显示 Engine running 即安装完成。打开 Settings → Resources → Advanced把Disk image location改到一个剩余空间大于 100GB 的磁盘点 Apply and restart——这一步防止镜像写满 C 盘。服务端部署三条命令起三个服务仓库里已经放好了部署编排文件deploy/ 目录下有完整版、轻量版、Linux 版、RTX 50 系列专用版四个 compose 配置。完整版推荐包含 ASR、TTS、视频生成三个服务。进入/deploy目录执行docker-compose up -d轻量版只要视频生成服务适合已单独具备克隆能力的机器docker-compose -f docker-compose-lite.yml up -d执行后耐心等待约半小时取决于网速下载镜像约消耗 70GB 流量建议连 Wi-Fi完成后在 Docker 里看到三个容器都变成 Running即部署成功轻量版则只有一个duix-avatar-gen-video注意镜像下载失败、卡在 request canceled多是 Docker Hub 官方源不稳定按 Docker 镜像加速器怎么配 给 Docker 配国内镜像源后重试。RTX 50 系列显卡30/40 系列 CUDA 12.8 用户也可用改执行docker-compose -f docker-compose-5090.yml up -d。客户端从仓库发布的官方构建包下载Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 双击Duix.Avatar-x.x.x.AppImage直接启动root 用户进桌面时需在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。Ubuntu 服务端用docker-compose -f docker-compose-linux.yml up -d前提是装好 NVIDIA 驱动nvidia-smi能显示显卡即 OK和 NVIDIA Container ToolkitDocker 调用 GPU 的必要组件。用 10 秒视频克隆数字人动作打开客户端准备一段 10 秒左右的视频——要求画面里是真人、正在说话、有声音——点击创建数字人上传。结果系统自动把视频拆成无声视频 音频两条线分别做形象建模和声音克隆训练完成后我的数字人列表里多出一张你的数字人卡片可以管理多个模型。文本或语音怎么生成口播视频文本驱动选中你的数字人输入文案系统自动把文字转成你克隆的语音并驱动数字人完成后我的作品里多一条可播放的视频。语音驱动直接上传音频文件数字人按音频的节奏和语调做口型与表情变化效果更贴近原声。API 集成Docker 启动后服务在本地暴露端口可通过http://127.0.0.1直接调用把数字人克隆能力接进自己的应用模特训练拆视频 声音克隆预处理src/main/service/model.js音频合成文本转语音src/main/service/voice.js视频合成音画合一支持水印开关、超分等参数src/main/service/video.js注意合成接口支持watermark_switch水印开关和chaofen超分辨率处理把低清画面放大变清晰等参数参考 src/main/service/video.js 中的调用示例。高频故障急救速查症状可能原因解法docker-compose up -d报连接超时Docker Hub 官方源不稳定配国内镜像加速器重启 Docker 后重试新建数字人报错视频没声音或没有人在说话换一段真人说话、有声音的 10 秒视频训练报 Connection refusedASR 服务启动慢或内存只有 16GB 没拉起服务端启动后等几分钟再克隆内存升到 32GB生成卡在 20%显存/内存不足显存尽量 8GB 以上降低分辨率或改用轻量版客户端连不上服务端容器没跑起来或端口被防火墙拦确认三个容器均 Running放行对应端口日志在哪里看客户端点右上角设置 → Open Log会直接打开日志目录服务端在 Docker 容器日志页复制报错内容方便自查或提问。文档、API与社区在哪官方常见问题与自查步骤doc/常见问题.md数字人 API 参考训练/语音/合成三类接口README_zh.md 的开放 API章节部署编排配置deploy/项目许可协议LICENSE仓库内设有技术交流与共创板块可扫码进交流群获取支持项目仍在快速迭代新系统适配、多语言界面、新显卡方案都在陆续更新建议部署前看一眼仓库最新版说明。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表