Wan2.2 S2V 数字人 阿里通义千问出品 这是一个音频驱动的电影视频生成模型
Wan2.2-S2V阿里通义千问出品 一个音频驱动的电影视频生成模型,极大地简化了视频制作过程,仅需提供一张静态图片和一段音频,模型便能生成面部表情自然、口型与音频高度一致、肢体动作流畅丝滑的电影级数字人视频。
Wan2.2-S2V支持分钟级长视频稳定生成,不止嘴动,手势、表情、姿态都能动。
推荐选择4090、4090 48G