Duix.Avatar 开源数字人本地部署指南:从 0 到生成第一条口播视频

发布时间:2026/9/11 11:03:29
Duix.Avatar 开源数字人本地部署指南:从 0 到生成第一条口播视频 Duix.Avatar 开源数字人本地部署指南从 0 到生成第一条口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想做一个会替你说话的 AI 数字人口播视频Duix.Avatar 是一款全离线、开源的数字人创作工具给它一段 10 秒视频就能克隆你的形象和声音输入文字稿即可生成口型匹配的口播视频。跟着本文操作一遍你就能在自己的电脑上跑通数字人本地部署做出第一条口播视频。它凭什么值得你花时间商业数字人平台按字数或按条收费做几条视频就是一笔不小的费用。Duix.Avatar 部署好之后不再按次计费项目本身支持全球免费商用只有用户量超 10 万或年营收超 1000 万美元以上的企业需要签商业许可协议。所有算力和数据都留在本地素材视频、声音样本、生成的作品都不离开你自己的电脑。相当于一个家用的录音棚加摄影棚钥匙只在你手里。硬件门槛也不夸张一块英伟达显卡、32GB 内存是推荐线主流游戏本或台式机基本够用。10 秒视频就能产出一个长得像你、声音像你的数字人。动手前花 2 分钟确认本地环境检查清单项目要求显卡英伟达 NVIDIA 显卡推荐 RTX 4070且驱动已装好内存32GB 及以上系统Windows 1019042.1526 或更高或 Ubuntu 22.04 Desktop磁盘WindowsC 盘空闲 100G存服务镜像、D 盘空闲 30G存数字人和作品Ubuntu空闲 100G软件DockerWindows 另需 WSL2Windows 系统在命令提示符执行wsl --list --verbose nvidia-smi看到 WSL 版本号、nvidia-smi打印出显卡信息就 OK。Ubuntu 系统在终端执行docker --version nvidia-smi看到 Docker 版本号、nvidia-smi打印出显卡信息就 OK。 提醒这个项目的算力全部跑在本地英伟达显卡上AMD 显卡或核显的服务是起不来的。内存或磁盘紧张的话后面可以只用精简配置启动单服务资源占用更小见再进一步。跟着做从 0 到跑起来1. 拉代码到本地预计耗时约 5 分钟打开终端Windows 用 PowerShell执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar这一步把项目源码复制到你的电脑。注意它只是源码和配置并不包含大模型文件模型等会儿由容器自动下载。✅ 确认做对了当前目录下能看到README_zh.md、package.json还有一个deploy文件夹。卡在这里的人最多git 拉取慢或超时。换个网络再试几次即可属于正常现象。2. 装 Docker、备好数据盘预计耗时约 20 分钟先认识一下 Docker它是打包好的小环境容器的运行工具服务都装在容器里不用你手动装一堆依赖。Windows 系统按顺序做四件事若wsl --list --verbose里没有系统先执行wsl --install过程中设置并记住用户名密码。执行wsl --update把 WSL 更新到新版。下载 Docker Desktop 的 Windows 版按向导装完首次启动时接受协议、跳过登录。如果 C 盘没有 100G 空闲就改镜像存放位置Docker Desktop → Settings → Resources → Advanced → 把 Disk image location 改到 D 盘点 Apply restart。图把 Docker 镜像目录指到数据盘Ubuntu 系统在终端执行sudo apt update sudo apt install docker.io sudo apt install docker-compose这一步装好 Docker 和它的编排工具 docker-compose一条命令管理多个服务。然后再装英伟达显卡驱动和 NVIDIA Container Toolkit让 Docker 能调用 GPU完整命令见项目 README 的 Ubuntu 章节。✅ 确认做对了Windows 上 Docker Desktop 左下角显示 Engine runningUbuntu 上docker --version和nvidia-smi都有正常输出。3. 起服务容器预计耗时约 30 分钟终端里执行cd deploy docker-compose up -d这条命令会下载三个服务镜像并启动它们总流量约 70G建议连 WiFi 耐心等待。三个服务各管一段asr 管语音识别tts 管语音合成gen-video 管视频合成。它们配合完成文字 → 语音 → 口型视频的完整链路。卡在这里的人最多报错里出现registry-1.docker.io ... Client.Timeout是 Docker Hub 连接不稳定。解决办法Docker Desktop → Settings → Docker Engine加上registry-mirrors国内镜像源Apply restart 后重跑命令。图服务容器日志页右上角为运行状态✅ 确认做对了Docker Desktop 的 Containers 列表里duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器的 STATUS 都是 Running且不反复重启。4. 装客户端并启动预计耗时约 10 分钟两种方式选一种直接安装推荐到项目的 Releases 页面下载与你系统对应的官方构建包Windows 是 .exe 安装包Ubuntu 是 .AppImage 免安装文件双击安装并启动。源码构建先装 Node.js 18在项目根目录执行npm install再执行npm run dev。客户端就是你日常操作的图形界面装完它后面所有动作都是点鼠标。✅ 确认做对了主界面出现Create Video做视频和Create Avatar做数字人两个入口下方是我的作品和我的数字模特列表。图客户端主界面第一次用创建数字人并生成第一条口播视频核心场景就一件事录一段自己的视频 → 生成数字人 → 用文字稿驱动它说。五步走完录素材手机录一段 10-15 秒的正脸视频。全程要有你在说话的声音光线亮一点背景干净别带环境噪音。创建模特点Create Avatar上传视频、起个名字开始训练。等训练完成几分钟后模型会出现在My Avatars列表里。写台词点Create Video选中刚建好的数字人输入台词文本。第一次建议 50 字以内越短越稳。生成预览点生成等 3-5 分钟当场播放看口型是否跟上语音。第一次建议参数素材 10-15 秒、台词 50 字内、语音参数全部保持默认。对效果不满意没关系换段台词重新生成即可数字人模型不用重训。图模特列表中已生成的数字人看到列表里出现一个像你的数字人就算跑通了。从这一刻起输入文字就能批量产出你的口播视频。再进一步精简版与 API 批量生成1. 资源紧张换精简版或 5090 配置# 精简版只启动一个视频合成服务资源占用更小 cd deploy docker-compose -f docker-compose-lite.yml up -d# 英伟达 50 系列显卡专用配置30/40 系列 cuda12.8 也可用 cd deploy docker-compose -f docker-compose-5090.yml up -d2. 想批量生成调这个接口服务启动后会在本地暴露端口视频合成接口是POST http://127.0.0.1:8383/easy/submit请求体逐行说明{ audio_url: 音频文件路径, // 用哪段音频驱动数字人 video_url: 数字人视频路径, // 用哪个数字人模型 code: 自己生成的唯一任务ID, // 用于查进度 chaofen: 0, // 固定值 watermark_switch: 0, // 固定值 pn: 1 // 固定值 }进度用GET http://127.0.0.1:8383/easy/query?code任务ID查询。接口的实际调用写法可以参考 src/main/service/video.js。踩坑速查现象大概率原因你做这一步docker-compose up -d报registry-1.docker.io超时Docker Hub 官方源连接不稳定Docker Desktop → Docker Engine 设置里加registry-mirrors镜像源Apply restart 后重跑创建模特时报Connection refusedASR 服务启动慢或内存太小16G 可能起不来服务端启动后等几分钟再操作内存不足先换精简版新增模特失败素材视频没有声音或不是人在说话重录素材必须有连续的人声程序要靠它做声音克隆服务日志出现File not exists数据目录映射不上常见于 Windows 缺 D 盘确认有 D 盘且空闲 30G 以上再到 deploy 目录重跑docker-compose up -d图服务端日志中的报错示例以上都没命中 → 去项目 Issues 页面搜Connection refusedregistryFile not exists等关键词。项目也整理了常见问题文档doc/常见问题.md。写在最后先录一段 10 秒视频把全流程走通一遍别急着抠效果。后面想调参数、调 API回头翻 deploy/ 目录里的几份配置文件就够了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询