恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频

  • 首页
  • 资讯中心
  • /
  • Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频

相关资讯

Nginx Proxy Manager 证书管理完全指南:HTTP 验证、DNS 验证与自定义证书的签发、续期与排障 2026/9/11 13:58:02
Dokku 升级完全指南:版本确认、安全更新与 apt / dokku-update / 源码三种升级路径详解 2026/9/11 13:58:02
PaddleOCR PP-StructureV2 智能文档分析系统全解析:版面分析、表格识别、关键信息抽取与版面恢复实战 2026/9/11 13:58:02

最新资讯

集团组织管控方案设计:框架、模块与实施要点
NHANES预测模型升级:多模型比较与DeLong检验实践
Recharts 仓库开发协作指南:从单元测试到视觉回归测试的完整工作流
Karakeep 社区生态全景:围绕自托管书签服务的第三方集成项目与自动化脚本解析
Taichi 外部数组数据交互实战:NumPy / PyTorch / Paddle 与 Taichi Field、Kernel 参数的完整互通指南
考虑碳减排的综合能源服务商合作运行优化策略复现详解

今日推荐

YOLO烟盒数据集目标检测训练全流程:标注校验、格式转换与模型复现
HuffPost新闻数据集解析:JSONL加载与时间感知分类实战
Budibase 本地开发环境搭建与运行指南:从全新克隆到 dev 栈启动的完整实践

本周热门

超人会飞不算本事:系统稳定依赖清晰规则与边界设计
超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论
基于CNN的调制信号识别:MATLAB实现时频图分类实战

本月精选

自研推理加速器Redwood:两周内实现PyTorch模型高效部署的实战教程
V4L2摄像头采集实战:从camera_client.rar到出图全流程解析
从“谁发明了钢琴键”到知识问答智能体:RAG与记忆工程实践

Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频

发布时间:2026/9/11 13:58:02
Duix.Avatar完整教程:零基础30分钟克隆你的第一个AI数字人视频 Duix.Avatar完整教程零基础30分钟克隆你的第一个AI数字人视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar是一款免费开源的AI数字人克隆项目。提交一段10秒左右的你的视频就能克隆你的形象和声音之后输入文案或上传音频它会自动生成口型同步的口播视频全程本地离线完成。想做数字人视频的自媒体创作者、老师和企业宣传团队都可以用它。 它能为你做些什么自媒体创作不用出镜让你的数字分身帮你念稿、口播视频产出节奏不再受拍摄排期限制教育培训把课程脚本交给数字人讲师批量产出风格统一的教学视频企业宣传用品牌数字人做产品介绍、客服口播形象统一、随时开工个人用途给婚礼、生日等场合做一份有你身影和声音的纪念视频主界面只有两个入口Create Video生成视频和Create Avatar创建数字人作品和数字人模型分别存在My Works和My Avatars里一眼就能找到。✅ 动手前环境自检清单先对照这张清单确认你的电脑够不够格再开始装环境系统Windows 1019042.1526或更高版本或 Ubuntu 22.04显卡必须有 NVIDIA 显卡且驱动装好推荐 rtx-4070 级别50系列显卡有专门部署方案内存32G 及以上必要16G 可能起不来服务CPU参考配置为第13代英特尔酷睿 i5-13400F磁盘WindowsC盘空闲 100G 以上放 Docker 镜像D盘空闲 30G 以上存数字人和作品Ubuntu空闲 100G 以上网络下载 Docker 镜像约消耗 70G 流量建议连 WiFi 跟着做三步部署完成第一步安装 DockerWindows先打开 PowerShell用wsl --list --verbose查看是否装过 WSL没有就先执行wsl --install。装好后运行下面这条命令把 WSL 更新到最新版网络原因可能失败多试几次wsl --update然后从 Docker 官网下载 Windows 版 Docker Desktop 安装并启动首次运行接受协议、跳过登录即可。Ubuntu先跑docker --version没装 Docker 的话执行下面三条命令安装sudo apt update sudo apt install docker.io sudo apt install docker-composeUbuntu 还需要正确安装 NVIDIA 显卡驱动并安装 NVIDIA Container Toolkit完整步骤见 README_zh.md装完用nvidia-smi验证能看到显卡信息才算成功。Windows 用户注意C盘空闲不足 100G 时在 Docker Desktop 的 Settings → Resources → Advanced 里用 Browse 把磁盘镜像位置改到剩余空间大于 100G 的磁盘。第二步启动服务端把项目克隆到电脑上克隆下来的目录里带deploy文件夹git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入项目的deploy目录Windows执行docker-compose up -dUbuntu执行cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d如果用的是 50 系列显卡30/40 系列且 CUDA 12.8 的也可以用把命令里的配置文件换成docker-compose-5090.yml即可配置偏低可以改用 lite 版只启动 1 个服务。耐心等待约 30 分钟镜像下完、Docker 里出现 3 个运行中的服务tts、asr、gen-video就说明服务端就绪了。第三步安装客户端去项目的 Releases 页面下载官方构建的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 直接双击Duix.Avatar-x.x.x.AppImage启动root 用户需改用终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。客户端打开并连上本地服务端部署就完成了。️ 完成你的第一个数字人视频打开客户端主界面左侧是Create Video右侧是Create Avatar右上角 Setting 菜单里还能查看用户协议、打开日志、切换语言。准备素材录一段 10 秒左右的视频要求是正面人脸清晰、画面里有人说话——声音克隆就靠这段声音没声音的视频无法建模。提交克隆点Create Avatar上传这段视频。这里有个新手容易踩的坑服务端刚启动时语音识别服务asr启动较慢建议等几分钟再提交否则可能报 Connection refused。训练本身需要几分钟取决于你的硬件。生成视频训练完成后在My Avatars里选中你的数字人模型输入要说的文案或上传音频文件点击生成。几分钟后一条口型与声音同步的口播视频就会出现在My Works里直接保存即可。️ 出了问题先看这里服务拉不下来或起不来怎么办打开 Docker确认三个服务duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video是否都是 Running 状态。如果报registry-1.docker.io连接超时说明 Docker Hub 连不上进入 Docker Desktop 的 Settings → Docker Engine在 JSON 里添加registry-mirrors国内镜像源点 Apply restart。用nvidia-smi检查显卡驱动——没有 NVIDIA 显卡或没装驱动三个服务是起不来的。创建数字人模型报错怎么办确认上传的视频有声音、且是人在说话这是声音克隆的必要条件。服务端刚启动时 asr 服务还在预热等几分钟再重试一次。如果机器内存低于 32G比如 16G服务可能根本启动不了这类报错先检查内存。定位不了问题怎么排查看客户端日志点右上角 Setting 菜单里的Open Log日志文件是 logs 目录下的main.log。看服务端日志在 Docker 里点开对应服务的 Logs 页签把关键报错复制出来。把服务端和客户端都更新到最新版本再试一次到deploy目录重新执行docker-compose up -d。 再往前走一步开放 API服务端启动后会在本地暴露端口模型训练、音频合成18180 端口和视频合成、进度查询8383 端口都能通过http://127.0.0.1调用串起来就能做批量视频生成接口实现可以直接看 src/main/service/ 目录。8 种语言脚本支持英语、日语、韩语、中文、法语、德语、阿拉伯语和西班牙语界面语言在 Setting 菜单里切换。免费商用全球范围免费商用用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议。架构上它由三个 Docker 服务组成基于 fun-asr 的语音识别、基于 fish-speech 的语音合成、负责视频合成的合成引擎客户端是一个 Electron 桌面应用。你不需要会编程也不需要花一分钱只需要一段 10 秒的视频和一台配置达标的电脑就能拥有自己的 AI 数字分身。现在就回到上面的第二步把deploy目录下的命令跑起来——30 分钟后你的第一个数字人视频就在等着你了。遇到问题先翻 常见问题绝大多数坑都有现成答案。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号