HeyGem.aiDuix.Avatar版本更新纪要1.0.6 新增 Ubuntu 部署、5090 支持附 4 个 Compose 方案选型【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar本文基于 HeyGem.ai项目名 Duix.Avatar仓库材料整理覆盖 1.0 系列开源至当前 1.0.6 的变更点Ubuntu 22.04、NVIDIA 50 系显卡、客户端英文界面并给出 4 套部署方案的选型与升级步骤。 1.0.6 的变更点有 3 项逐条核对README.md 开头的Whats New通知只有两条——Nvidia 50 系显卡版本通知与新增 Ubuntu 版本通知结合 package.json 中的版本号 1.0.6此次更新实际包含 4 个变更点Ubuntu 版本正式发布完成 Ubuntu 22.04 Desktop内核 6.8.0-52-generic的适配验证其他 Linux 版本暂未测试。NVIDIA 50 系显卡支持基于 5090 测试通过30/40 系显卡用户升级 CUDA 12.8 后也可采用该方案5090 方案使用 PyTorch 官方预览版。客户端国际化客户端程序界面补充英文。已知问题修复GitHub issue #304、#292。新旧差异如下每行均对应仓库内文件便于对照核查能力维度1.0 早期版本当前版本1.0.6仓库出处服务端系统仅 Windows 10新增 Ubuntu 22.04 Desktop内核 6.8.0-52-genericREADME_zh.md、deploy/docker-compose-linux.ymlNVIDIA 显卡30/40 系新增 50 系5090 实测PyTorch 官方预览版README.md、deploy/docker-compose-5090.yml客户端语言仅中文中文 英文README.md「新增 Ubuntu 版本通知」已知问题存在 #304、#292已修复README.md「Whats New」客户端形态Windows 安装包Windows .exe Linux AppImage免安装electron-builder.yml 4 套部署方案deploy 目录下每个 compose 文件的服务与端口deploy/ 目录下共有 4 个 compose 文件。Compose 是 Docker 的容器编排描述文件一条up -d命令即可拉起全部服务四套方案的差别在于服务数量与镜像版本方案compose 文件服务构成本地端口适用场景Windows 标准docker-compose.yml3 个TTS 语音合成 ASR 语音识别 视频合成18180 / 10095 / 838330/40 系显卡Windows 轻量docker-compose-lite.yml1 个仅视频合成Duix.Avatar-gen-video8383只需要视频合成环节50 系显卡docker-compose-5090.yml2 个TTS5090 镜像 视频合成5090 镜像不含 ASR18180 / 8383509030/40 系 CUDA 12.8 亦可用Ubuntudocker-compose-linux.yml3 个同标准方案18180 / 10095 / 8383Ubuntu 22.04两个容易忽略的细节5090 方案把镜像替换为guiji2025/fish-speech-5090与guiji2025/duix.avatar-5090且不启动 ASRfun-asr服务而 TTS 服务在模特训练环节依赖 ASR 做语音识别见 doc/常见问题.md 中的 Connection refused 排错记录做声音克隆前需确认语音识别环节可用。Windows 方案把数据目录挂载到D:\duix_avatar_dataLinux 方案挂载到~/duix_avatar_data该路径是与容器内部约定的修改需同步改 compose 文件。部署前的硬件与磁盘空间自查README 给出的硬性要求与推荐配置必须有 NVIDIA 显卡且驱动安装正确——本项目所有算力在本地没有显卡或驱动时服务无法启动。推荐配置i5-13400F、内存 32G 及以上必要、RTX 4070。Windows 用户另需D 盘空闲 30GB 以上存放数字人与作品数据C 盘 100GB 以上存放 Docker 镜像不足时可在 Docker Desktop 设置中把镜像目录改到空间更大的盘。首次部署下载流量约 70GBREADME 提示建议在 WiFi 环境下预留半小时左右。 1.0.x 升级到 1.0.6服务端拉镜像、客户端重装服务端重新执行 compose 拉取新镜像服务端完全由 Docker 镜像构成升级即拉取新镜像并重启。doc/常见问题.md 中的标准更新动作就是到 /deploy 目录重新执行docker-compose up -d。尚未拉取代码时的完整步骤git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai/deploy docker-compose up -d5090 用户将命令替换为cd deploy docker-compose -f docker-compose-5090.yml up -d轻量方案同理使用-f docker-compose-lite.yml。启动后在 Docker 中看到 3 个 Running 状态的服务即成功轻量方案为 1 个。客户端exe 安装包或 AppImageWindows安装官方构建的Duix.Avatar-x.x.x-setup.exe项目内置 electron-updater 自动更新模块配置见 dev-app-update.yml。Ubuntu双击Duix.Avatar-x.x.x.AppImage即可启动无需安装以 root 用户登录桌面时双击可能无效需在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。若需从源码构建客户端依赖 Node.js 18。故障排查3 项自查与 2 个日志入口服务起不来或创建模特报错时先查的 3 项服务是否全部处于 Running 状态标准/Linux 方案 3 个、轻量 1 个、5090 方案 2 个nvidia-smi是否显示显卡信息驱动未安装是最常见的启动失败原因。服务端与客户端是否都更新到最新版本项目更新频繁问题可能已在新版修复。doc/常见问题.md 中还有两个高频问题拉镜像报连接超时在/etc/docker/daemon.json中配置registry-mirrors国内镜像源文档内附可直接使用的示例。新增模特时报错用于创建模特的视频必须有人声且是人在说话程序要用这段声音做声音克隆无声视频不可用。客户端与服务端日志的查看位置客户端日志%AppData%\heygem.ai\logs下的main.log可通过客户端设置—打开日志入口直接打开。服务端日志在 Docker Desktop 中点开对应服务查看输出镜像名分别为guiji2025/fish-speech-zimingTTS、guiji2025/fun-asrASR、guiji2025/duix.avatar视频合成。日志出现Connection refused时重点确认 10095 端口的 ASR 服务是否启动成功。不想买 GPU 的路径Coze 平台直接使用数字人克隆README 中给出了本地部署与 API 服务的对照表本地部署适合希望深度定制、可修改代码的技术型用户API 服务无需购买 GPU 服务器、维护简单但无法修改源码仅能通过接口扩展。此外项目已在 Coze 平台上线数字人克隆智能体与插件无需本地部署即可体验选择本地部署时还有一个许可细节开源版本支持全球免费商用但用户量超过 10 万或年营收超过 1000 万美元的企业需签署商业许可协议协议全文见仓库根目录的 Duix.Avatar model community Licensing Agreement.pdf。下一步以上变更点均出自 README 通知、package.json 与 deploy/ 配置进一步可查阅部署与升级完整步骤README_zh.md4 套方案配置文件deploy/拉镜像失败、创建模特报错等排错doc/常见问题.md【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考