Duix.Avatar 本地部署:10秒视频克隆数字分身,离线生成口播视频

发布时间:2026/10/3 8:35:17

Duix.Avatar 本地部署:10秒视频克隆数字分身,离线生成口播视频 Duix.Avatar 本地部署10秒视频克隆数字分身离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar外包一条口播视频给工作室3000元起步、交付要等一周把员工的人脸和声音素材传到第三方云端服务一旦泄露处置成本远高于制作费。这是很多人不敢用数字人的两个原因。Duix.Avatar 是一款免费开源、全离线运行的数字人工具上传10秒左右的视频就能克隆你的脸和声音之后输入文案或上传音频直接生成口型同步的播报视频。使用门槛是一台带 NVIDIA 显卡的电脑加 DockerWindows 和 Ubuntu 都能完成部署。它是什么10秒视频克隆脸和声音Duix.Avatar 是一个桌面客户端加本地 Docker 服务的组合上传10秒左右的清晰视频系统自动拆出人脸特征和声音特征生成一个长你、声音也你的数字分身。之后你输入文案或上传音频文件它就生成口型同步的口播视频脚本支持中、英、日、韩、法、德、阿拉伯、西语共8种语言。它不做三件事不替你拍摄和剪辑素材不提供云端托管全部算力在你本机不支持非 NVIDIA 显卡。4个理由选本地部署素材不出机器。三个服务启动后所有接口调用都走本机 127.0.0.1声音服务18180端口视频合成8383端口人脸和声音素材全程不碰外网。10秒素材就够。克隆只需要一段10秒左右的视频不用长时间对着镜头录制素材准备成本几乎可以忽略。商用免费。开源协议支持全球免费商用只有用户量超10万或年营收达1000万美元的企业需要另签商业许可。部署路径短。服务端就是一条 docker-compose 命令客户端装完即用不需要自己配深度学习环境。从零到跑通5步装好服务端和客户端硬件基准按官方推荐配置来NVIDIA 显卡推荐 RTX 4070、32G 内存、Docker 存储盘100G空闲、Windows 用户另需 D 盘30G存放数据。第1步验证显卡驱动。终端执行nvidia-smi。看到显卡型号和驱动版本这步通过提示找不到命令或驱动先去 NVIDIA 官网装好驱动再重新验证。第2步克隆项目。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar验证点进入目录后能看到src和deploy两个文件夹。第3步装好 Docker。Windows 用 Docker DesktopWSL 2 后端Ubuntu 22.04 用 apt 装 docker 和 docker-compose。执行docker --version能看到版本号即通过。第4步一条命令拉起三个服务。首次会拉取三个镜像约70G流量耗时半小时左右取决于网速cd deploy docker-compose up -dUbuntu 换成 linux 编排文件执行docker-compose -f docker-compose-linux.yml up -dRTX 50 系列显卡用docker-compose-5090.yml显存紧张可用 lite 编排文件它只跑一个视频合成服务。验证点Docker 界面里 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器均为 Running 状态lite 版只有一个 duix-avatar-gen-video。C 盘不足100G时在 Docker Desktop 的 Settings → Resources → Advanced 里用 Browse 把磁盘镜像位置改到别的盘。第5步安装客户端。到项目的 Release 页下载对应系统的安装包Windows 双击 exe 安装Ubuntu 双击 AppImage 直接运行root 桌面用户需在终端加--no-sandbox启动。验证点打开后看到创建视频和创建数字分身两张卡片即可使用。还能做什么3个批量口播场景自媒体口播批量生产输入3个选题文案操作选中同一个数字分身依次粘贴文案生成输出3条口型同步的口播成片直接排期发布企业内部培训标准化输入讲师一段10秒自我介绍录像操作克隆讲师分身输入课程讲稿输出讲师形象和声音讲解的系列课程视频同一内容多语言出片输入同一篇讲稿的中文和英文版本操作用同一个分身分别驱动生成输出两个语言的口播视频文件投不同渠道3个最常见的坑及修复方法坑1镜像下载慢或失败概率最高。判断依据docker-compose up -d长时间卡在拉取docker images里缺镜像首装约70G流量国内直连 Docker Hub 不稳定。解决动作在 Docker 的 Docker Engine 配置里加 registry-mirrors 国内镜像源重启后重新拉取。坑2服务起不来或反复重启。判断依据容器状态是 restarting 或 exited日志报 GPU 相关错误本项目全部算力在本地显卡驱动没装好服务一定起不来。解决动作更新 NVIDIA 驱动nvidia-smi能显示显卡后重新执行docker-compose up -d。坑3克隆或生成时报file not exists。判断依据客户端进度卡住或生成失败容器日志出现 FileNotFoundError多为服务端与客户端版本不一致。解决动作客户端点右上角设置齿轮选 Open Log 看本地日志服务端看对应容器日志定位报错然后在 deploy 目录重新执行docker-compose up -d把服务更新到最新镜像再试。关键代码在哪4个值得先看的路径想读代码或接入自己的系统先看这四个地方模型训练服务调用形象克隆训练接口创建数字分身的入口逻辑语音合成服务声音素材上传与 TTS 合成调用视频合成服务提交视频生成任务并轮询进度Docker编排文件三个服务的定义、端口映射和 GPU 挂载方式服务端启动后在本地暴露 HTTP 接口模特训练、音频合成、视频合成的参数都写在前三个文件里想接到自己的工作流直接调 127.0.0.1 的 18180 和 8383 端口即可。一句话总结适合谁不适合谁如果你需要高频产出口播视频、在意人脸和声音素材的隐私、手头正好有 NVIDIA 显卡这个开源数字人工具值得花一个下午部署如果你没有 GPU或不打算碰服务端可以先看它配套的 API 服务不必自己装。下一步动作先在终端跑一遍nvidia-smi确认机器达标达标就按第4步开始拉镜像。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/10/3 9:40:23

KingbaseES PLSQL异常处理实战:从Oracle迁移到生产级设计

凌晨两点,一套从 Oracle 迁移到 KingbaseES 的批处理又在第二天早上准时"死"在了日志里。前端同事把报错截图发过来,屏幕上只有一行干巴巴的 ORA-06502: 数值转换错误 ,跑了十几万行的存储过程,愣是看不出来是哪个步骤…

2026/10/3 9:40:22

AI工程从零到生产:提示词、RAG、Agent与可观测性实战指南

最近一直在琢磨一件事:很多同学说自己在“做大模型应用”,但聊到工程细节,得到的回答往往是“调用一下API,把提示词写好就完事了”。真的只有这么简单吗?我起了一个项目叫ai-engineering-from-scratch,目标…

2026/10/3 9:35:22

从零手搓AI工程:自动微分与训练循环实战

1. 从零手搓AI工程:为什么我不建议你直接调包很多人一上来就想搞AI工程,第一反应是找个现成的框架,pip install 一把梭,然后跑个 demo 就觉得自己入门了。我见过太多这样的例子:简历上写着“熟悉深度学习”&#xff0c…

2026/10/2 8:16:46

东莞市品牌网站建设报价常见报错与解决

东莞品牌网站建设报价单背后:一份保姆级建站教程避坑实录 网站做好了没人访问,这大概是很多老板最头疼的事。花了大几万做的品牌站,上线后流量惨淡,比路边摊还冷清。别急着骂外包公司,很多“东莞品牌网站建设报价”里藏着不少猫腻,比如用模板站冒充定制…

2026/10/2 18:20:53

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/1 10:48:55

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/10/3 0:04:31

国内大学生必备的AI写作辅助软件是哪款?

国内高校学生在论文写作过程中,越来越依赖AI辅助工具提升效率,主流方案以本土化全流程工具为核心,结合通用大模型与专业插件,覆盖选题构思、框架搭建、初稿撰写、查重降重、格式调整等关键环节,本文将深入解析当前主流…

2026/10/3 0:04:31

Codex接入Jev模型完整指南:配置方法、本地部署与踩坑排查

最近不少人在讨论 Codex 搭配 Jev 这套玩法,我一开始没太当回事,直到自己把 Jev 接进 Codex跑了几轮编码任务之后,才明白那些说“直接起飞”的人是怎么想的。Codex 作为工具本身已经够能打了,但模型固定、上下文策略固定&#xff…

2026/10/3 0:04:31

GitHub 热门: NVIDIA/Model-Optimizer

👋 Hi,我擅长 AI 大模型应用落地、意识解码与 AI 开发工具链 。 💡 创业路上,用技术换时间,一起把 AI 变成生产力 🚀 >GitHub 热门: NVIDIA/Model-Optimizer 凌晨两点,你刚把跑通了的 Qwen3.…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑