优云智算
控制台
立即注册

Wan2.2-S2V-14B: 音频驱动的电影视频生成

通过音频驱动的图片转视频生成软件,支持声音克隆功能

镜像大小
120 GB
当前版本
v1.0
累计部署
124
累计运行
122 h
最近更新
2026-02-02

运行环境

框架版本
PyTorch-2.8.0
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+11

Wan2.2-S2V-14B: 音频驱动的图片转视频生成

镜像简介

通过一段音频素材和图片生成一个全新的人物讲话视频,人物说话内容就是音频素材内容,可实现音唇同步

镜像使用指南

1、首先点击右侧蓝色按钮【使用该镜像创建实例】

image.png

2、GPU选择48G或是96G型号,低显存会导致报错终止,点击下方蓝色按钮【立即部署】

image.png

3、稍等一两分钟后实例便会运行,显示【运行中】后继续等待1分钟左右初始化,再点击右侧【SD-WebUI】按钮,即可打开WebUI操作界面

image.png

注意

分辨率建议480*832,高分辨率太耗时

生成480P以上视频需要96G显存

如果使用声音克隆功能,音频样本建议3-10秒

0 个镜像 · 被使用 124
版本日志
v1.0最新
2025-09-08
评分
0.0
暂无评分
我的评分
未评分
Wan2.2-S2V-14B: 音频驱动的电影视频生成一键部署 | 优云智算