尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
如何通过 Duix.Avatar 开放 API 调用 /easy/submit 与 /easy/query 完成数字人视频合成?
如何通过 Duix.Avatar 开放 API 调用 /easy/submit 与 /easy/query 完成数字人视频合成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 部署本地 Docker 服务端后除了使用图形客户端还开放了一组基于http://127.0.0.1的 API其中最关键的是视频合成接口/easy/submit提交合成任务与/easy/query查询任务进度。本文的目标是在你已经按 README_zh.md 完成服务端部署的前提下直接用这两个接口提交一段“音频 模特视频”的数字人口型合成任务并轮询拿到最终视频文件。整个流程不依赖客户端界面适合把视频合成能力集成到自己脚本或后端服务中。前置条件服务端已启动且数据目录已挂载调用http://127.0.0.1:8383/easy/...的前提是duix-avatar-gen-video容器已运行它同时决定了输入输出文件放在哪里。在仓库的 deploy 目录下启动服务端Windows 用docker-compose.ymlUbuntu 22.04 用 docker-compose-linux.yml50 系列显卡用 docker-compose-5090.ymlcd /deploy docker-compose up -d确认三个 Docker 服务都处于 Running 状态lite 版本只有一个服务Duix.Avatar-gen-video。README 的“提问前自查步骤”明确指出所有算力都在本地没有英伟达显卡或未安装驱动时这些服务起不来。启动后注意 deploy/docker-compose.yml 中duix-avatar-gen-video服务给出的两个约定它们决定了后面参数怎么传端口映射8383:8383即宿主机上通过http://127.0.0.1:8383访问合成服务卷挂载把本地face2face数据目录Windows 为d:/duix_avatar_data/face2faceLinux 为~/duix_avatar_data/face2face映射进容器的/code/data输入音频、模特视频和合成结果都通过这个目录交换。准备输入文件音频与模特视频/easy/submit需要两个文件见 README_zh.md “视频合成”一节video_url模特视频路径即一段 10 秒左右的、用于克隆外貌的视频audio_url驱动口型的音频路径。在客户端的实现中src/main/config/config.js 的assetPath.model这两个参数传的是相对路径Windows 相对D:\duix_avatar_data\face2face\tempLinux 相对~/duix_avatar_data/face2face/temp。也就是说把文件放到上述temp目录后传文件名即可该目录位于被映射进容器的face2face卷内服务在容器内才能读到。如果你手头没有现成音频可以通过同一服务端的 TTS 接口生成README 中“音频合成”一节http://127.0.0.1:18180/v1/invoke这一步依赖已完成的“模特训练”http://127.0.0.1:18180/v1/preprocess_and_tran返回的asr_format_audio_url与reference_audio_text。如果只需要合成口型视频而音频已有可跳过 TTS 分支直接把音频文件放入temp目录。调用 /easy/submit 提交合成任务向http://127.0.0.1:8383/easy/submit发送 POST 请求请求体按 README 给出的参数{ audio_url: xxxx.wav, video_url: yyyy.mp4, code: xxxxxxxx-xxxx-xxxx-xxxx-xxxxxxxxxxxx, chaofen: 0, watermark_switch: 0, pn: 1 }参数说明均来自 README_zh.mdaudio_url音频路径video_url视频路径code唯一 key客户端使用crypto.randomUUID()生成见 src/main/service/video.js 的makeVideoByF2F保证每个任务一个唯一值即可chaofen、watermark_switch、pnREADME 标注为固定值保持0、0、1。提交后的判断方式以客户端实现为准src/main/api/f2f.js 的makeVideo发起请求后src/main/service/video.js 检查返回结果——code 10000表示任务提交成功任务进入pending状态等待轮询否则视为失败失败原因在返回的msg字段中。轮询 /easy/query 直到拿到结果视频提交成功后用code轮询进度GET http://127.0.0.1:8383/easy/query?code${taskCode}GET 请求参数taskCode就是提交入参中的code。客户端每 2 秒轮询一次src/main/service/video.js 的loopPending你可以按同样节奏轮询。返回结果怎么读README 没有给出示例响应以下判断规则来自客户端loopPending的实际处理逻辑src/main/service/video.js顶层code为10000时再看data.status1合成中data.progress与data.msg记录当前进度继续轮询2合成成功data.result是生成视频的相对路径客户端用它拼接本地数据目录WindowsD:\duix_avatar_data\face2face\tempLinux~/duix_avatar_data/face2face/temp后读取视频文件3合成失败失败原因在data.msg顶层code为9999、10002或10003时任务失败原因在msg字段。也就是说一个完整可核对的任务闭环是/easy/submit返回code: 10000→ 轮询/easy/query直到data.status变为2→ 在face2face数据目录容器内为/code/data对应目录下根据data.result取出视频文件。限制与排查服务未全部 Running 时接口不可用按 README 的“提问前自查步骤”先检查三个服务状态并确认机器有英伟达显卡且已正确安装驱动。lite 版本的边界docker-compose-lite.yml只启动一个服务Duix.Avatar-gen-video没有 TTS/ASR 服务因此前文“用 TTS 接口生成音频”的可选分支在 lite 部署下不可用音频必须由你自行提供。任务失败时/easy/query返回的msg或data.msg即失败描述README 建议查看服务端日志——在 Docker 中打开对应容器的日志操作并确认服务端/客户端是否为最新版本服务端可重新执行docker-compose up -d更新。接口字段含义以仓库中客户端源码src/main/api/f2f.js、src/main/service/video.js、src/main/service/voice.jsREADME“开放 API”一节列出的参考实现为准仓库未提供独立 API 文档。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

5060Ti 8GB显存还够用吗?从游戏到AI大模型的显存选购指南

5060Ti 8GB显存还够用吗?从游戏到AI大模型的显存选购指南

2026年都过了一半,关于“8GB显存到底够不够用”这件事,论坛里还能吵出几千楼,我一点都不意外。真正把情绪点燃的,是近期5060Ti 8GB版和16GB版之间那一千六百元的价差——同样一张核心、同样一块PCB,好像只是显存容量不…

📅 2026/9/15 14:20:02
二手车价格预测:Python数据挖掘全流程实战

二手车价格预测:Python数据挖掘全流程实战

简介:本资源是一份面向计算机及相关专业学生的数据挖掘实战项目,聚焦二手车价格预测这一典型回归任务,适用于课程设计、期末大作业及毕业设计场景,尤其适合缺乏项目经验但希望独立完成高分作业的学习者。压缩包共26个文件&#xf…

📅 2026/9/15 14:20:02
DiffSynth-Studio 中的 FLUX.2 全指南:推理、低显存部署与模型训练实战

DiffSynth-Studio 中的 FLUX.2 全指南:推理、低显存部署与模型训练实战

DiffSynth-Studio 中的 FLUX.2 全指南:推理、低显存部署与模型训练实战 【免费下载链接】DiffSynth-Studio Enjoy the magic of Diffusion models! 项目地址: https://gitcode.com/GitHub_Trending/dif/DiffSynth-Studio FLUX.2 是 Black Forest Labs 训练并…

📅 2026/9/15 14:20:02
MORE NEWS

更多资讯

📰

Encore 原始端点(Raw Endpoints)完全指南:在 Go 后端中直接操作 HTTP 请求

Encore 原始端点(Raw Endpoints)完全指南:在 Go 后端中直接操作 HTTP 请求 【免费下载链接】encore The infrastructure platform for the intelligence era 项目地址: https://gitcode.com/GitHub_Trending/encor/encore 本指南基于 …

📰

PyTorch ResNet18 在 CIFAR-10 上复现 95.4% 准确率的工程实践

简介:本资源是一份面向深度学习初学者与PyTorch实践者的Cifar10图像分类实战项目,聚焦ResNet18网络结构原理与端到端训练流程,解决小规模数据集上模型精度提升与泛化能力优化问题。压缩包共6个文件(5个Python脚本1个Markdown说明文…

📰

MQ、工作流引擎与分布式调度全解析:从选型到组合落地

做了这么多年后端,我在技术评审会上被问过最多的问题,几乎都是同一个:这个任务到底该丢 MQ,还是上工作流引擎,还是直接用分布式调度?每次听到这种问题,我都想把这三个东西摆到桌面上&#xff0c…

📰

Instructor 简单对象提取模式:用 Pydantic 定义 Schema,把非结构化文本转为类型安全的结构化对象

Instructor 简单对象提取模式:用 Pydantic 定义 Schema,把非结构化文本转为类型安全的结构化对象 【免费下载链接】instructor structured outputs for llms 项目地址: https://gitcode.com/GitHub_Trending/in/instructor 本文是 Instructor 官…

📰

智能车竞赛讯飞组别源码复盘:从视觉识别到控制链路的工程沉淀

简介:一份面向智能车竞赛与机器人操作系统(ROS)学习者的参赛源码包,来自第十八届全国大学生智能汽车竞赛讯飞组别,最终获得全国三等奖。包内共1065个文件,压缩包整体仅10.16MB,主要涵盖C源码与头…

📰

Cosmos Reason 2音乐制作软件的核心功能与实战技巧

1. Cosmos Reason 2 初探:为什么它值得你投入时间?第一次打开Cosmos Reason 2时,我被它那个看似复杂但实则精妙的界面震撼到了。作为一个从Reason 1.0时代就开始使用的老用户,我可以负责任地说,这个版本完全重构了音乐…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬