优云智算
控制台
立即注册

StableAvatar快速生成对口型数字人视频 12gb显卡爆改by科哥

对口型数字人视频wan2.1优化项目 12gb显卡爆改by科哥

镜像大小
130 GB
当前版本
v1.1
累计部署
103
累计运行
137 h
最近更新
2026-04-27

运行环境

框架版本
PyTorch-2.8
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+10

StableAvatar快速生成对口型数字人视频

模型介绍:

StableAvatar 是复旦大学、微软亚洲研究院等推出的创新音频驱动虚拟形象视频生成模型。 模型通过端到端的视频扩散变换器,结合时间步感知音频适配器、音频原生引导机制和动态加权滑动窗口策略,能生成无限长度的高质量虚拟形象视频。模型解决了现有模型在长视频生成中出现的身份一致性、音频同步和视频平滑性问题,显著提升生成视频的自然度和连贯性,适用虚拟现实、数字人创建等场景。

使用教程

创建实例

1、选择本镜像创建实例,推荐选择4090 GPU进行部署

image.png

2、实例创建后,选择Jupyterlab打开

image

启动应用

1、打开jupyter左侧的启动器:

image.png

2、点击启动双箭头启动按钮:

image.png

3、查看启动进度,运行完成后返回控制台打开SD-WebUI

image.png

4、返回控制面板打开“SD-WebUI”

image.png

SD-WebUI运行使用界面截图

image.png

image.png

image.png

bug反馈可以加入科哥专属群交流➕ 广告勿进!

描述图片内容

更多高级指令,可以进入jupyterlab,自行操作,例如:

  • 查看进程:
ps -ef |grep python
  • 终止进程:
kill -9 pid
  • 重启程序:
cd  /root && bash run.sh

有bug请微信科哥或加群: 312088415

科哥在UCloud镜像列表【不断更新中】:

image.png

鸡你太美认证作者
个人主页
0 个镜像 · 被使用 103
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.1最新
09-30
修复notebook启动失败的问题
评分
0.0
暂无评分
我的评分
未评分
StableAvatar快速生成对口型数字人视频 12gb显卡爆改by科哥一键部署 | 优云智算