恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

如何在自己电脑上做出会说话的数字人:Duix.Avatar 口播视频快速上手指南

  • 首页
  • 资讯中心
  • /
  • 如何在自己电脑上做出会说话的数字人:Duix.Avatar 口播视频快速上手指南

相关资讯

AI Agent用户记忆系统设计:跨会话状态管理实战 2026/9/11 9:22:41
数据分析与科学计算:从基础到实战的核心技术解析 2026/9/11 9:22:41
Reflex Enterprise 认证页面定制指南:为 rxe.AuthPlugin 编写自定义登录、回调、注销与 403 页面 2026/9/11 9:22:41

最新资讯

Claude Code插件深度评测:Context7与安全审查实战指南
Onyx 仓库实战:用 Greptile check-pr 技能实现 GitHub / GitLab / Perforce 全平台 PR 自动检查与修复
PLC恒压供水系统设计与节能优化实践
CMSIS-5架构深度解析:嵌入式底层标准与工程落地实践
字符编码全解析:从ASCII到UTF-8的演进与实践
Medusa 官方教程写作规范指南:MDX 结构、组件与文档工程最佳实践

今日推荐

YOLO烟盒数据集目标检测训练全流程:标注校验、格式转换与模型复现
HuffPost新闻数据集解析:JSONL加载与时间感知分类实战
Budibase 本地开发环境搭建与运行指南:从全新克隆到 dev 栈启动的完整实践

本周热门

超人会飞不算本事:系统稳定依赖清晰规则与边界设计
超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论
基于CNN的调制信号识别:MATLAB实现时频图分类实战

本月精选

自研推理加速器Redwood:两周内实现PyTorch模型高效部署的实战教程
V4L2摄像头采集实战:从camera_client.rar到出图全流程解析
从“谁发明了钢琴键”到知识问答智能体:RAG与记忆工程实践

如何在自己电脑上做出会说话的数字人:Duix.Avatar 口播视频快速上手指南

发布时间:2026/9/11 9:22:41
如何在自己电脑上做出会说话的数字人:Duix.Avatar 口播视频快速上手指南 如何在自己电脑上做出会说话的数字人Duix.Avatar 口播视频快速上手指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar录一条 3 分钟的口播视频往往要录半小时、剪两小时想改一句话就得整段重来。Duix.Avatar 是一款开源的 AI 数字人工具包上传一段 10 秒左右的说话视频就能克隆出你的形象和声音之后输入文案全部在本地离线生成口播视频素材不出门。先花 30 秒认识你的数字人工作台一句话定义它是能跑在普通 N 卡电脑上的全离线数字人生成工具。核心价值就三条单个分身制作零成本不用买建模和动画服务素材和成片都不出本机隐私留在自己手里文字、语音双驱动输一段文案就能开播三步跑通从空白机器到第一条口播视频第一步备好机器和驱动硬性条件先对一遍N 卡 装好的驱动终端跑nvidia-smi能出显卡信息才算过内存 32G 起C 盘留 100G 以上给镜像数据盘再留 30GWindows 10 19042 以上或 Ubuntu 22.04Windows 上先确认 WSL2 就绪wsl --install wsl --updateDocker Desktop 装好后进 设置 → Resources把磁盘镜像位置挪到空间更大的盘C 盘不足 100G 时必做第二步启动服务端容器后台是三个 Docker 服务语音识别、语音克隆、视频合成。拉下仓库跑自带的 compose 文件git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d首次拉镜像约 70G耗时半小时左右Docker 里看到 3 个容器都 Running 即成功。显存吃紧就换 lite 版只保留视频合成一个服务docker-compose -f docker-compose-lite.yml up -d第三步装客户端出第一条片Windows安装 release 里的Duix.Avatar-x.x.x-setup.exeUbuntu终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox打开后流程只有三下上传 10 秒说话视频 → 等模型训练完成 → 输入文案生成口播视频就出片了。数字人是怎么炼出来的一次克隆任务后台拆成四个环节特征提取样片拆成静音视频和音轨面部用来训练分身模型数据层见 src/main/dao/f2f-model.js语音识别fun-asr 服务把样片里你说过的话转成文字作为克隆基准语音克隆fish-speech 服务拿样片音频做参考用你的音色朗读任意新文案监听本机 18180 端口口型合成视频合成服务逐帧对齐嘴型、产出成片监听 8383 端口实现见 src/main/service/video.js四步都跑在 127.0.0.1 的本地端口上接口是开放的。照着 src/main/service/voice.js 写脚本就能把这条数字人流水线接进你自己的系统。报错速查90% 的卡壳都在这几处容器起不来九成是显卡驱动没装好。算力全在本地没有 N 卡三个服务根本拉不起来。拉镜像超时给daemon.json加国内镜像源{ registry-mirrors: [https://docker.m.daocloud.io] }新建模特报 file not exists样片没声音或没有人说话。声音克隆依赖这段音轨必须录清晰人声克隆时 Connection refusedASR 服务冷启动慢等服务端起后再等几分钟再操作内存只有 16G 可能直接起不来。查日志客户端右上角设置点 Open Log 看本地日志文件服务端问题去容器界面点复制按钮取日志玩法清单跑通之后能干什么自媒体口播量产录一次文案无限换一周更 7 条不难企业培训片讲师出镜一次以后更新课程只改文案多语言出镜脚本支持中、英、日、韩等 8 种语言一个分身跑多个市场再远一点实时互动的数字分身进会议并自动生成字幕、描述即成片的多模态生成、跨平台的统一数字身份——都是社区正在盯的方向。动手前的一句话10 秒视频炼一个数字人本地离线出片这是 Duix.Avatar 给你的起点。有 N 卡就今天动手备环境、起容器、传样片一小时后你的第一个分身应该已经在跑了。官方文档doc/常见问题.md【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号