Duix.Avatar本地部署教程10秒素材克隆数字分身离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的数字人克隆工具上传一段 10 秒左右的说话视频它会把你的形象和声音克隆下来之后用文本或音频就能驱动这个分身生成口播视频全程完全离线素材不出本机。适合需要批量做口播视频的人自媒体创作者、企业培训师、教育工作者。脚本支持中文、英文、日文、韩文、法文、德文、阿拉伯文、西班牙文 8 种语言。️ 环境要求本地部署AI数字人先看这几项参数所有算力都在本地没有 NVIDIA 显卡基本跑不起来。对照下表先确认机器项目最低要求推荐值显卡NVIDIA 显卡且已装好驱动RTX 4070 及以上内存32GB32GB 以上CPUi5 级别13代 Intel Core i5-13400F系统Windows 10 19042.1526 或 Ubuntu 22.04同最低要求磁盘100GB 空闲SSD软件Docker最新版 Node.js 18Windows 用 Docker DesktopWindows 上磁盘要分两处服务镜像放 C 盘需 100GB数字人和项目数据放 D 盘需 30GB。Node.js 18 只在用源码自己构建客户端时才需要直接装官方预编译包可以不管。 部署主线装 Docker、起服务、装客户端一条线走完整条流程一次拉完镜像大约 30 分钟中间不需要额外配置。先克隆项目仓库git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar装完仓库之后接着装 Docker。Windows 先在终端执行wsl --updateWSL 是 Windows 自带的运行 Linux 容器的子系统再安装 Docker Desktop。C 盘空间不足 100GB 的话进 Docker Desktop 的 Settings → Resources → Advanced用 Browse 把镜像存储位置换到空间更大的盘。Ubuntu 22.04 则直接在终端里装 Docker并安装 nvidia-container-toolkit 让容器能调用 GPUsudo apt update sudo apt install docker.io docker-compose sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart dockerDocker 就绪后启动服务端。配置写在deploy目录的docker-compose.yml里执行下面命令后 Docker 会自动拉取三个镜像并起容器首次下载约 70GB 流量cd deploy docker-compose up -dUbuntu 换成docker-compose -f docker-compose-linux.yml up -d显卡显存不够可以换docker-compose-lite.yml只启动一个视频生成服务。看到fun-asr语音识别、fish-speech-ziming语音合成、duix.avatar视频生成三个容器都是 Running服务端就部署完成了。客户端单独装Windows 到项目 Release 页下载最新安装包双击Duix.Avatar-x.x.x-setup.exe按向导完成Ubuntu 下载 AppImage 后用chmod x赋予执行权限直接运行若以 root 用户登录桌面启动时要加--no-sandbox参数。 数字分身创建方法从上传素材到成片部署完成后所有操作都在客户端界面里完成先建分身再用分身出片。三个服务全部 Running 后启动客户端点右上角 Create Avatar上传一段 10 秒左右的说话视频。注意视频里必须包含本人的声音程序要靠音轨做声音克隆正面拍摄、光线充足效果更稳。系统会把素材拆成无声视频和音频分别提取面部特征与声音特征完成训练训练完分身就出现在 My Avatars 列表。可以创建多个模型按名字搜索、一键切换不同用途各存一个。分身就绪后点 Create Video 驱动它两种方式文本驱动输入脚本分身朗读并生成对应口型脚本可用上面 8 种语言语音驱动直接上传音频文件口型跟着音频的节奏和语调走。生成结果进入 My Works 列表可回放和检索。背后是客户端通过127.0.0.1调用本地 API 完成模型训练、视频合成、语音处理分别在 src/main/service/ 的 model.js、video.js、voice.js 三个文件里想接进自己的工作流从这里读起。用它解决什么两个最值得上手的场景企业培训视频。录一段专家 10 秒的自我介绍克隆成分身后把课件内容贴成脚本文本即可生成标准化培训视频。收益在于内容更新只改脚本、不重新拍摄制作周期从数周压到数小时一次录制的专家形象可以复用到多个课程。自媒体批量生产。建好自己的数字分身把文章转成视频脚本批量生成口播视频再依次发布到各平台。制作流程从写脚本、拍摄、剪辑三步压缩为输入脚本一步参考官方口径内容制作时间减少约 80%日更因此成为常态。⚠️ 跑不起来的常见原因按现象对号入座常见的翻车点集中在 GPU 环境和镜像源两处按现象排查最快。拉镜像时报Client.Timeout或连接取消。最大可能是 Docker Hub 官方源不稳定。打开 Docker Engine 页面在 JSON 配置的registry-mirrors里加一个国内镜像地址重启 Docker 再执行docker-compose up -d。服务起不来或反复重启。本项目算力全在本地 GPU 上驱动没装或 nvidia-container-toolkit 没配好三个容器都起不来。先用nvidia-smi确认显卡可见再核对 toolkit 的安装步骤。新增模特时报错说视频没有有效声音。上传的是静音视频或画面里没人说话声音克隆依赖素材音轨换一段 10-15 秒的人在说话的视频即可。训练定制模特时Connection refused。多半是识别服务还没就绪。点客户端右上角 Settings → Open Log 查客户端日志或在 Docker 里打开容器复制服务端日志对照仓库的 doc/常见问题.md 定位。三个服务 Running、客户端能连上本地 API数字人克隆的完整链路就算通了。服务端更新后重新执行一次docker-compose up -d拉到最新镜像即可。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考