尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
Duix.Avatar本地部署教程:3步完成离线数字人克隆,生成第一条口播视频
Duix.Avatar本地部署教程3步完成离线数字人克隆生成第一条口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想给自己做一条口播视频又不想把脸和声音交给云端服务。Duix.Avatar是一款完全开源、离线运行的数字人克隆项目拍一段 10 秒左右的人像视频就能克隆你的外貌与声音之后输入文字或上传音频即可驱动口型自动生成口播视频。全部算力跑在你自己的英伟达显卡上全程无需联网支持 Windows 与 Ubuntu 22.04 两套系统。下面从零开始带你把离线数字人部署完整跑通。谁适合用先对号入座这款离线数字人克隆与视频生成工具把一条口播视频的制作成本压缩到一段 10 秒视频 一句文案。对照下面几类情况看看你中招没有典型场景解决的问题想自己做口播短视频的自媒体人不依赖收费云端数字人服务制作成本从数十万美元级降到约 1000 美元课程与培训内容的制作团队固定讲解员反复出镜不必每次重新找人拍摄、后期数据不能出域的合规场景全离线运行人脸与声音数据不离开本机要把数字人能力接入自家产品的开发者提供开放 API不用从零搭建 ASR、TTS、口型管线非中文内容创作者脚本支持中、英、日、韩、法、德、阿拉伯、西语共 8 种语言三步跑起来装环境、起服务、开客户端第一步 准备环境与依赖先说结论整条数字人克隆链路都在本地 GPU 上跑硬性前提是英伟达显卡 已装驱动nvidia-smi能显示显卡信息即通过外加 Docker。推荐配置为 i5-13400F、32G 及以上内存、RTX 4070 级别显卡。操作要点Windows 10 需 19042.1526 或更高版本D 盘留 30G 以上空间存放模型与作品C 盘存放 Docker 镜像需 100G 以上空闲。如果 C 盘空间紧张安装完 Docker 后可以重新指定镜像存放位置到另一块磁盘第二步 启动三个服务端服务服务端由 Docker Compose 拉起三个服务ASR端口 10095、语音合成 TTS端口 18180、视频合成 gen-video端口 8383。操作要点进入项目deploy/目录执行docker-compose up -d。首次运行约下载 70G 镜像视网速耗时半小时左右建议连 WiFi 跑。Docker 里看到三个服务均为 Running 状态即成功。手上还没有项目源码的话先执行git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar。第三步 打开客户端客户端是官方构建的安装包不用自己编译代码。操作要点Windows 下载Duix.Avatar-x.x.x-setup.exe双击安装Ubuntu 22.04 直接双击Duix.Avatar-x.x.x.AppImage启动。若以 root 用户进入桌面需在终端加--no-sandbox参数启动。各系统差异合并成一张表项目Windows 1019042.1526Ubuntu 22.04其他 Linux 发行版Docker 前置先装 WSLwsl --install、wsl --update再装 Docker Desktopsudo apt install docker.io docker-compose未做兼容性测试以仓库内文档为准GPU 前置英伟达显卡驱动显卡驱动 NVIDIA Container Toolkit—服务端启动命令docker-compose up -ddocker-compose -f docker-compose-linux.yml up -d—客户端双击.exe安装双击.AppImage启动—跟着场景用一遍建模型、出口播视频用 10 秒视频克隆自己的形象打开客户端主页点右侧Create Avatar入口上传一段 10 秒左右、人在说话的实拍视频。数字人克隆会在这段视频上一次性完成模型学习你的五官与面部轮廓声音则基于视频里的音频复刻。这一步省掉了两件事——不用单独录干净的干声也不用手工搭建 3D 资产。注意视频必须有声音且是人在说话否则训练会直接报错。训练完成后模型出现在 My Avatars 标签页生成过的作品列在 My Works输一段文字生成口播视频切到Create Video入口选中刚建好的模型输入文案等待生成即可拿到一条带口型的口播视频。文字驱动虚拟形象在本地完成文字→语音→口型整条链路省掉了人工配音、再逐帧对口的两个步骤。如果你手上已有录音文件也可以直接上传音频代替文字输入。用 API 把数字人克隆能力接入自家产品Docker 启动后三个服务在127.0.0.1上暴露端口模特训练127.0.0.1:18180/v1/preprocess_and_tran、音频合成127.0.0.1:18180/v1/invoke、视频合成127.0.0.1:8383/easy/submit进度查询用127.0.0.1:8383/easy/query。请求参数示例可直接参考 src/main/service/model.js、src/main/service/video.js、src/main/service/voice.js。开放 API意味着你不必重写识别、合成、对口型整套管线调两个接口就能拿回口播视频。踩坑与自检四个高频问题1.docker-compose up -d拉镜像失败报request canceled可能原因Docker Hub 官方源连接不稳定处理在 Docker 设置 → Resources → Docker Engine 的registry-mirrors字段里添加国内镜像源然后重启 Docker2. 新增模特时报错可能原因上传的视频没有声音或视频中没有人说话处理换一段人在说话、声音清晰的实拍视频声音克隆依赖这段音频做参考3. 定制模特报Connection refused可能原因ASR 服务启动较慢或内存不足16G 可能起不来处理服务端启动后等几分钟再执行克隆内存按推荐配置留足 32G4. 三个服务起不来可能原因机器没有英伟达显卡或驱动未正确安装处理先执行nvidia-smi确认能显示显卡信息再核对驱动版本提问之前建议先自查一遍三个服务是否都是 Running、显卡驱动是否装好、版本是否最新更多情况见常见问题。进阶调优选读想省磁盘空间用 lite 版docker-compose -f docker-compose-lite.yml up -d只启动Duix.Avatar-gen-video一个服务50 系列显卡5090 已测试CUDA 12.8 的 30/40 系也可用docker-compose -f docker-compose-5090.yml up -d数据存放约定Windows 端模型与作品数据在d:/duix_avatar_data语音数据放voice\data目录均可在 docker-compose 中改服务端升级在deploy/目录重新执行docker-compose up -dheygen-tts 反复重启到仓库 Issues 里搜对应讨论商用授权全球免费商用用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议详见 LICENSE克隆的形象与声音请确保是你本人或已获授权的使用生成内容建议用于个人学习与工作场景。部署中踩了坑、或对功能有想法欢迎到项目仓库提 Issue和开源社区一起把数字人部署这件事做得更顺手。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

React Hook Form 与 Formik 深度对比:如何为 React 表单管理选择最佳方案

React Hook Form 与 Formik 深度对比:如何为 React 表单管理选择最佳方案

React Hook Form 与 Formik 深度对比:如何为 React 表单管理选择最佳方案 【免费下载链接】refine A React Framework for building internal tools, admin panels, dashboards & B2B apps with unmatched flexibility. 项目地址: https://gitcode.com/GitHub…

📅 2026/9/11 7:42:59
Claudian 响应慢怎么办:3 个高收益设置让它快回来

Claudian 响应慢怎么办:3 个高收益设置让它快回来

Claudian 响应慢怎么办:3 个高收益设置让它快回来 【免费下载链接】claudian An Obsidian plugin that embeds Claude Code/Codex as an AI collaborator in your vault 项目地址: https://gitcode.com/GitHub_Trending/cl/claudian 在 Obsidian 里用 Claudi…

📅 2026/9/11 7:42:59
华硕笔记本又吵又烫?GHelper 轻量替代奥创中心实战手册

华硕笔记本又吵又烫?GHelper 轻量替代奥创中心实战手册

华硕笔记本又吵又烫?GHelper 轻量替代奥创中心实战手册 【免费下载链接】g-helper Lightweight Armoury Crate alternative for Asus laptops with nearly the same functionality. Works with ROG Zephyrus, Flow, TUF, Strix, Scar, ProArt, Vivobook, Zenbook, E…

📅 2026/9/11 7:42:59
MORE NEWS

更多资讯

📰

在 Airi 中使用 VueUse useQRCode:响应式生成二维码的完整实战指南

在 Airi 中使用 VueUse useQRCode:响应式生成二维码的完整实战指南 【免费下载链接】airi 💖🧸 Self hosted, you-owned Grok Companion, a container of souls of waifu, cyber livings to bring them into our worlds, wishing to achieve …

📰

Qt C++画板实现:多模式绘图与像素级橡皮擦

简介:本资源是一份面向C初学者与高校计算机专业学生的Qt图形界面开发实践项目,聚焦于绘图类应用的核心功能实现,适合作为期末大作业或GUI编程入门实训。项目完整实现了基于Qt Widgets与Graphics View框架的画板程序,支持直线绘制、…

📰

iced 图形绘制实战:用 Canvas 与 Path 绘制旋转圆弧(arc 示例全解析)

iced 图形绘制实战:用 Canvas 与 Path 绘制旋转圆弧(arc 示例全解析) 【免费下载链接】iced A cross-platform GUI library for Rust, inspired by Elm 项目地址: https://gitcode.com/GitHub_Trending/ic/iced 导读 本文以 iced 仓库…

📰

DouK-Downloader:抖音 TikTok 视频批量下载与数据采集完整指南

DouK-Downloader:抖音 TikTok 视频批量下载与数据采集完整指南 【免费下载链接】TikTokDownloader 抖音 / TikTok 平台作品下载/数据采集工具 项目地址: https://gitcode.com/GitHub_Trending/ti/TikTokDownloader 想存下一个博主的全部作品,却只…

📰

Jackett 评分筛选:一次搜出 50 条结果,哪几条值得下载

Jackett 评分筛选:一次搜出 50 条结果,哪几条值得下载 【免费下载链接】Jackett API Support for your favorite torrent trackers 项目地址: https://gitcode.com/GitHub_Trending/ja/Jackett 在 Jackett 里搜一部《沙丘》,回来五十多…

📰

云原生自动化方案OpenClaw实战与优化指南

1. 为什么选择云原生自动化方案? 三年前我还在用本地服务器跑自动化脚本,直到某天硬盘突然报废导致整个爬虫系统瘫痪。那次事故让我损失了价值上万的业务数据后,我彻底转向了云服务。阿里云最新推出的OpenClaw免代码自动化方案,实…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬