Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成

发布时间:2026/9/11 8:30:43

Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成 Duix.Avatar Linux 部署完整指南三步在本地跑通免费 AI 数字人视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的 AI 数字人工具只需一段 10 秒左右的视频就能克隆你的形象和声音输入文案或上传音频即可离线生成口播视频。本文带你用 Docker 在 Linux 上完成部署从环境检查到第一次生成视频全程可自查、可复现。 先认识一下 Duix.Avatar形象声音双克隆全程离线Duix.Avatar 是 Duix.com 开源的数字人工具箱核心能力有三点高精度克隆用一段真人视频同时构建面部模型和声音模型五官轮廓和语调语速都能还原文字与语音双驱动写文案或直接上传音频数字人自动对口型全离线运行所有计算都在本机完成视频不上传隐私数据不出内网它支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语八种语言脚本普通电脑即可把专业级数字人的制作成本打下来值得动手试一次。✅ 开跑前自查对照清单确认你的机器部署前先把条件对一遍任何一条不满足都会让后面的步骤卡住。项目要求说明系统Ubuntu 22.04已验证其他桌面 Linux 理论可行未做兼容性测试显卡NVIDIA 显卡 正确驱动硬性条件算力全在本地参考配置i5-13400F / RTX 4070官方推荐档位可低配但内存不能少内存32GB 及以上必要条件16GB 可能导致 ASR 服务起不来硬盘100GB 以上可用首次拉取镜像约消耗 70GB 流量依赖Docker Docker Compose服务端基于容器运行一条命令确认 GPU 驱动就绪nvidia-smi能打印出显卡和驱动版本这项就算通过。️ 部署主线配好 GPU 容器运行时拉齐三个服务安装 Docker 并配置 GPU 容器运行时如果系统还没有 Docker用 apt 装好基础组件sudo apt update sudo apt install docker.io docker-compose docker --version打印出版本号即安装成功。接下来装 NVIDIA Container Toolkit这是 Docker 调用 GPU 的必要组件distribution$(. /etc/os-release;echo $ID$VERSION_ID) \ curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.listsudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker最后一条命令无报错、Docker 服务正常重启GPU 运行时就配好了。克隆仓库并启动服务端把代码拉到本地用 Linux 专用编排文件一键启动git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d首次启动要下载约 70GB 镜像耗时半小时左右网速决定一切建议挂着跑。验证服务是否就绪跑完之后检查容器状态docker-compose ps看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器都是 Running服务就起齐了。再打开 Docker 容器日志确认 TTS 服务打印出 ready for startup、nginx 开始监听说明推理端点已可被调用 首次使用从一段视频到一条口播片服务端就绪后从项目发布页下载 Linux 版客户端 AppImage双击即可运行无需安装./Duix.Avatar-x.x.x.AppImage如果是 root 用户运行要在终端加参数./Duix.Avatar-x.x.x.AppImage --no-sandbox打开客户端后的路径很短点右上角Create Avatar上传一段 10 秒左右、画面清晰且本人在说话的带声音视频等待克隆完成得到一个数字人形象再点Create Video选择刚建的数字人输入文案或上传音频几分钟后就能在 My Works 里看到一条口型同步的口播视频。 踩坑速查三个高频问题拉镜像连接超时现象docker-compose up -d报request canceled while waiting for connection。 原因Docker Hub 官方源在国内连接不稳定。 解法在/etc/docker/daemon.json添加registry-mirrors国内镜像源后重启 Docker 再拉取。克隆形象报 Connection refused现象新建模特时 ASR 服务连接被拒绝任务失败。 原因ASR 服务启动比视频合成服务慢很多客户端没有等它就提交任务。 解法服务端启动后先等几分钟再操作克隆如果机器内存只有 16GBASR 服务可能根本起不来需按清单升到 32GB。客户端行为异常说不清现象界面报错模糊找不到原因。 原因客户端日志默认不展示。 解法点右上角 Setting 菜单里的 Open Log 打开日志把关键报错贴出来对照排查。 进阶入口API 与源码开放 API 在 Docker 启动后本地可用覆盖模特训练、音频合成、视频合成与进度查询细节见 README_zh.md形象训练与合成服务src/main/service/model.js视频合成服务src/main/service/video.js语音服务src/main/service/voice.js客户端请求封装src/main/api/服务端编排文件deploy/docker-compose-linux.yml 写在最后Duix.Avatar 的价值在于把形象与声音双克隆、离线口播生成这两件事压到一套可以自查的部署流程里跑通之后所有生成都在本机闭环。遇到卡点先看 doc/常见问题.md社区更新频繁提交 issue 通常也能得到快速响应。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/9/11 8:30:42

标定板分辨率怎么选?深圳源头厂家选型与避坑指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/11 8:30:42

从ETL到现代数据管道:数据编排的演进逻辑与实践

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/11 9:36:17

个人开发者接入Agent开放平台:从Skill配置到上线避坑全指南

前阵子我接到一个挺普遍的需求:个人开发者想把 WorkBuddy 开放平台上已经沉淀好的 Agent 能力接进自己的小工具里,但不知道怎么下手。说实话,这类平台型接入的问题我几乎每个月都会遇到,大多数人卡住的点不在 API 本身&#xff0c…

2026/9/11 9:36:17

context-mode 实战:大模型上下文管理与提示词工程的核心方法

1. 什么是 context-mode:先从一次失败的对话说起 去年我给一个电商团队做客服机器人优化,对方抱怨最多的就是:“模型时聪明时蠢,同一个问题换个问法就答非所问。”我上去一看,他们的 prompt 只有一句话:“你…

2026/9/11 9:36:17

Kimi LeetCode 71. 简化路径 Rust实现

LeetCode 71. 简化路径 思路:按 / 分割路径,用一个栈存放目录名: 遇到空串或 .:跳过遇到 ..:栈非空则弹栈其他:入栈 最后用 / 拼接。 impl Solution {pub fn simplify_path(path: String) -> String {let mut stack: Vec<&str> Vec::new();for part in path.spli…

2026/9/11 9:36:17

Kimi LeetCode 71. 简化路径 Python3实现

LeetCode 71「简化路径」&#xff1a;把 Unix 风格的绝对路径规范化为最短形式。规则&#xff1a;. 忽略、.. 弹出上级、多个 / 视为一个、返回以 / 开头。 思路&#xff1a;栈 按 / 切分后依次处理每一段&#xff1a; "" 或 "."&#xff1a;忽略"…

2026/9/10 16:39:38

超人会飞不算本事:系统稳定依赖清晰规则与边界设计

开头先不绕弯子。“#斯坦李吐槽dc 所以超人是无缘无故会飞的嘛哈哈哈哈哈哈哈锤哥真是技术人才啊&#xff01;#雷神 #复联”这类调侃式短标题&#xff0c;第一波冲击力在于它把两个宇宙的角色塞进同一个吐槽箱里&#xff0c;但细想一下就能发现&#xff0c;它真正碰到的根本不是…

2026/9/10 11:16:38

超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论

把“蜘蛛侠 vs 超人”放在 CSDN 上聊&#xff0c;可能很多人第一反应是走错片场了。但如果把这两个角色看成“两个持续运营了 80 多年的文化产品”&#xff0c;你会发现&#xff0c;这场比较本质上是两个不同 IP 策略的长期结果对比&#xff1a;超人赢在定义了整个超级英雄题材…

2026/9/9 16:31:09

基于CNN的调制信号识别:MATLAB实现时频图分类实战

简介&#xff1a;本资源是一套面向通信工程与信号处理方向学习者、研究者的深度学习实践方案&#xff0c;聚焦调制信号自动检测与识别这一典型无线通信任务&#xff0c;解决传统方法依赖人工特征、低信噪比下性能下降等痛点。压缩包共12个文件&#xff08;10.73MB&#xff09;&…

2026/9/10 12:32:02

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行&#xff0c;Type-C接口算是典型的“看着简单&#xff0c;做起来全坑”的东西。光引脚就24个&#xff0c;高低速信号、电源、控制线全部塞在一个小小的连接器里&#xff0c;如果PCB布局不做规划&#xff0c;打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/10 15:19:50

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/10 15:49:53

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码