优云智算
控制台
立即注册
镜像社区
我的收藏

优云智算镜像社区 - 海量AI模型一键部署

快捷筛选

官方镜像免费镜像支持自启动

AIGC热门

数字人视频超分OCR识别AI漫剧AI音乐AI电商AI应用

图像/视频生成

ComfyUIWanZ-ImageQwen-ImageLTXInfiniteTalkLongCatFlux混元Lora训练SD3D生成图片生成图片编辑视频生成视频编辑

语音/TTS生成

IndexTTSQwen3-TTSCosyVoiceSVC语音合成语音分离语音识别

LLM

DeepSeekQwenGLM推理框架行业模型文本模型ChatBot

计算机视觉

VL视觉理解目标检测图像分割三维重建具身智能

科学计算

分子动力生物信息物理模拟数据分析

其他

其他
默认排序
数字人
RecommendCount
LiveTalking
LiveTalking
123
@lipku
lipku认证作者
4478
81609H
更新时间2026-06-16
支持自启动
LiveTalking镜像提供实时交互数字人解决方案,支持ERNerf、MuseTalk、Wav2Lip,实现单张人脸照片驱动的超低延迟(<100ms)唇形同步、表情及头部运动控制。
LiveTalking镜像提供实时交互数字人解决方案,支持ERNerf、MuseTalk、Wav2Lip,实现单张人脸照片驱动的超低延迟(<100ms)唇形同步、表情及头部运动控制。
0/小时
数字人
RecommendCount
最强AI数字人InfiniteTalk-图片和视频数字人
最强AI数字人InfiniteTalk-图片和视频数字人
629
@与AI同行
与AI同行认证作者
16543
101639H
更新时间2026-03-31
支持自启动
支持图片数字人、视频数字人、双人数字人,支持说话+唱歌对口型、长视频、完整歌曲生成、批量生成、高清放大!
支持图片数字人、视频数字人、双人数字人,支持说话+唱歌对口型、长视频、完整歌曲生成、批量生成、高清放大!
0/小时
视频生成
RecommendCount
LTX-2.3视频生成合集!支持文生视频、图生视频、数字人视频等
LTX-2.3视频生成合集!支持文生视频、图生视频、数字人视频等
308
@与AI同行
与AI同行认证作者
4754
12457H
更新时间2026-05-30
支持自启动
开源版Sora2发布,LTX-2.3整合包合集,支持文生视频、图生视频、数字人!支持20s视频、1080P视频直出、批量队列生成、高清放大!
开源版Sora2发布,LTX-2.3整合包合集,支持文生视频、图生视频、数字人!支持20s视频、1080P视频直出、批量队列生成、高清放大!
0/小时
语音合成语音克隆
RecommendCount
SVC-Fusion
SVC-Fusion
135
@aiguoliuguo
aiguoliuguo认证作者
7817
44183H
更新时间2026-06-29
本整合包将整合So-Vits-SVC4.1、RVC、DDSP-SVC-6.3/6.1/6.0、ReFlow-VAE-SVC多种SVC模型训练及推理
本整合包将整合So-Vits-SVC4.1、RVC、DDSP-SVC-6.3/6.1/6.0、ReFlow-VAE-SVC多种SVC模型训练及推理
0/小时
Lora训练图片生成其他
二次元Anima的Lora训练UI
二次元Anima的Lora训练UI
140
@梦影Erislia
2199
12171H
更新时间2026-07-18
二次元AnimaBase的Lora训练UI,一键打标训练
二次元AnimaBase的Lora训练UI,一键打标训练
0/小时
视频生成视频编辑
开源版Google Omni,视频编辑加速版,视频元素添加+删除+修改 | 视频消除物体 | 去水印 | 去字幕 | 换背景 | 风格转换 | 视频参考
开源版Google Omni,视频编辑加速版,视频元素添加+删除+修改 | 视频消除物体 | 去水印 | 去字幕 | 换背景 | 风格转换 | 视频参考
0
@与AI同行
与AI同行认证作者
6
13H
更新时间2026-07-17
支持自启动
开源版Google Omni,视频编辑加速版,视频元素添加+删除+修改 | 视频消除物体 | 去水印 | 去字幕 | 换背景 | 风格转换 | 视频参考
开源版Google Omni,视频编辑加速版,视频元素添加+删除+修改 | 视频消除物体 | 去水印 | 去字幕 | 换背景 | 风格转换 | 视频参考
0/小时
VL视觉理解三维重建目标检测
ardy-AI驱动动作生成与可视化
ardy-AI驱动动作生成与可视化
0
@匹夫
匹夫认证作者
0
0H
更新时间2026-07-17
一句话描述到电影级3D动作生成
一句话描述到电影级3D动作生成
0.15/小时
语音合成
超强AI音色克隆,OmniVoice长文本优化!音色克隆 | 各地方言 | 音色保存 | 多音字 | SRT字幕生成语音 | 多人对话 | 批量生成
超强AI音色克隆,OmniVoice长文本优化!音色克隆 | 各地方言 | 音色保存 | 多音字 | SRT字幕生成语音 | 多人对话 | 批量生成
0
@与AI同行
与AI同行认证作者
0
0H
更新时间2026-07-17
支持自启动
超强AI音色克隆,OmniVoice长文本优化!音色克隆 | 各地方言 | 音色保存 | 多音字 | SRT字幕生成语音 | 多人对话 | 批量生成
超强AI音色克隆,OmniVoice长文本优化!音色克隆 | 各地方言 | 音色保存 | 多音字 | SRT字幕生成语音 | 多人对话 | 批量生成
0/小时
ComfyUI图片生成图片编辑
Krea-2-GGUF-Style,风格化迁移,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
Krea-2-GGUF-Style,风格化迁移,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
2
@刘悦的技术博客
刘悦的技术博客认证作者
1
0H
更新时间2026-07-17
支持自启动
Krea-2-GGUF-Style,风格化迁移,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
Krea-2-GGUF-Style,风格化迁移,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
0/小时
ComfyUI视频生成视频编辑
SCAIL2
SCAIL2
0
@Time-AI
Time-AI认证作者
1
0H
更新时间2026-07-17
支持自启动
SCAIL2,包括动作迁移,角色替换,多角色交互,Lora,续写视频等
SCAIL2,包括动作迁移,角色替换,多角色交互,Lora,续写视频等
0/小时
语音合成
VoxCPM2微调专用版
VoxCPM2微调专用版
0
@雨落实战
雨落实战认证作者
0
0H
更新时间2026-07-17
支持自启动
VoxCPM2微调专用版
VoxCPM2微调专用版
0/小时
IndexTTS语音合成AI应用
dots.tts 0.2.1 官方升级,48kHz高保真无损克隆,低显存,TTS音色克隆,AI配音,支持50系显卡
dots.tts 0.2.1 官方升级,48kHz高保真无损克隆,低显存,TTS音色克隆,AI配音,支持50系显卡
2
@余子越Talk
余子越Talk认证作者
5
22H
更新时间2026-07-16
支持自启动
一款超高质量语音合成TTS的开源模型,dots.tts 小红书开源!
一款超高质量语音合成TTS的开源模型,dots.tts 小红书开源!
0/小时
语音合成语音识别
ChatTTS-ui-0.95
ChatTTS-ui-0.95
0
@萌新Clare
萌新Clare认证作者
1
2H
更新时间2026-07-16
文本转语音tts
文本转语音tts
0/小时
图片生成Lora训练Flux
Krea2的Lora训练
Krea2的Lora训练
18
@梦影Erislia
149
1232H
更新时间2026-07-16
Krea2的Lora训练
Krea2的Lora训练
0/小时
ComfyUI图片生成图片编辑
Krea2限制解除全功能开放版|24套生成·编辑·控制·高清放大工作流
Krea2限制解除全功能开放版|24套生成·编辑·控制·高清放大工作流
3
@AI-KSK
AI-KSK认证作者
20
33H
更新时间2026-07-16
支持自启动
**Krea2全功能创作镜像,整合24套核心工作流,覆盖文生图、图像编辑、精准控制、多图参考与高清放大等能力,一站式体验Krea2强大创作能力,满足设计、商业视觉与AI艺术创作需求。**
**Krea2全功能创作镜像,整合24套核心工作流,覆盖文生图、图像编辑、精准控制、多图参考与高清放大等能力,一站式体验Krea2强大创作能力,满足设计、商业视觉与AI艺术创作需求。**
0/小时
OCR识别AI应用Qwen3-TTS
有声书生成
有声书生成
1
@鹄仙
鹄仙认证作者
1
1H
更新时间2026-07-16
通过OCR识别文字,然后TTS生成有声书
通过OCR识别文字,然后TTS生成有声书
0.1/小时
数字人
SentiAvatar
SentiAvatar
0
@有黑眼圈的小竹熊
0
0H
更新时间2026-07-16
3D数字人动作生成
3D数字人动作生成
0.3/小时
ComfyUI图片生成图片编辑
IdeoGram-4-Instant_int8-convrot-文生图,单模型8步采样,单提示词,图生图,文生图,6G显存可用,No-Safety-Filter,批量任务,支持50系
IdeoGram-4-Instant_int8-convrot-文生图,单模型8步采样,单提示词,图生图,文生图,6G显存可用,No-Safety-Filter,批量任务,支持50系
1
@刘悦的技术博客
刘悦的技术博客认证作者
3
0H
更新时间2026-07-15
支持自启动
IdeoGram-4-Instant_int8-convrot-文生图,单模型8步采样,单提示词,图生图,文生图,6G显存可用,No-Safety-Filter,批量任务,支持50系
IdeoGram-4-Instant_int8-convrot-文生图,单模型8步采样,单提示词,图生图,文生图,6G显存可用,No-Safety-Filter,批量任务,支持50系
0/小时
语音合成SVCAI音乐
So-VITS-SVC-CU128 (即开即用, 无需部署)
So-VITS-SVC-CU128 (即开即用, 无需部署)
3
@SHthemW
SHthemW认证作者
1
0H
更新时间2026-07-16
支持自启动
So-VITS-SVC的2026全新Fork, 已经预配置好环境, 开箱即用. 支持Cuda12.8和RTX50系显卡, 训练/推理速度大大加快!
So-VITS-SVC的2026全新Fork, 已经预配置好环境, 开箱即用. 支持Cuda12.8和RTX50系显卡, 训练/推理速度大大加快!
0/小时
语音合成语音识别
Dots.TTS,6G显存可用,情绪迁移,接口api使用,流式接口,支持超长文本,声音克隆
Dots.TTS,6G显存可用,情绪迁移,接口api使用,流式接口,支持超长文本,声音克隆
0
@刘悦的技术博客
刘悦的技术博客认证作者
1
2H
更新时间2026-07-14
支持自启动
Dots.TTS,6G显存可用,情绪迁移,接口api使用,流式接口,支持超长文本,声音克隆
Dots.TTS,6G显存可用,情绪迁移,接口api使用,流式接口,支持超长文本,声音克隆
0/小时
视频生成
超快AI数字人,AvatarLipSync V1版,超快生成速度
超快AI数字人,AvatarLipSync V1版,超快生成速度
0
@与AI同行
与AI同行认证作者
8
0H
更新时间2026-07-13
支持自启动
超快AI数字人,AvatarLipSync V1版,超快生成速度
超快AI数字人,AvatarLipSync V1版,超快生成速度
0/小时
AI漫剧
AutoAnimation短剧漫剧自动化工具
AutoAnimation短剧漫剧自动化工具
58
@IAI666
356
1374H
更新时间2026-07-13
支持自启动
AutoAnimation短剧漫剧自动化工具及配套ComfyUI包含ZImage、flux2-kelin、qwenedit2511、wan2.2、qwen-tts、index-tts
AutoAnimation短剧漫剧自动化工具及配套ComfyUI包含ZImage、flux2-kelin、qwenedit2511、wan2.2、qwen-tts、index-tts
0.15/小时
ComfyUI图片编辑图片生成
Krea-2-GGUF-ControlNet,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
Krea-2-GGUF-ControlNet,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
3
@刘悦的技术博客
刘悦的技术博客认证作者
20
28H
更新时间2026-07-12
支持自启动
Krea-2-GGUF-ControlNet,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
Krea-2-GGUF-ControlNet,姿态保持,6G显存可用,洗图,文生图,自定义lora,图生图,自动提示词,支持50系,批量任务队列
0/小时
视频编辑其他
视频字幕去除器webUI二次修改汉化版
视频字幕去除器webUI二次修改汉化版
0
@鸡你太美
鸡你太美认证作者
0
0H
更新时间2026-07-12
支持自启动
视频字幕去除器webUI二次修改汉化版
视频字幕去除器webUI二次修改汉化版
0/小时
OCR识别
Unlimited-OCR文本识别
Unlimited-OCR文本识别
0
@鹄仙
鹄仙认证作者
2
2H
更新时间2026-07-11
Unlimited-OCR文本识别
Unlimited-OCR文本识别
0/小时
ComfyUI图片生成Flux
flux2-klein-9b最全能的图片编辑工作台
flux2-klein-9b最全能的图片编辑工作台
2
@匹夫
匹夫认证作者
22
29H
更新时间2026-07-10
功能包括:文生图-图片编辑--模特试穿-场景融合-多图参考-人物换脸-姿势参考-材质转移-AI画板
功能包括:文生图-图片编辑--模特试穿-场景融合-多图参考-人物换脸-姿势参考-材质转移-AI画板
0/小时
ComfyUILTX视频生成
LTX2.3-10Eros v1.4 FP8|图生视频·音频驱动三流程整合镜像
LTX2.3-10Eros v1.4 FP8|图生视频·音频驱动三流程整合镜像
5
@AI-KSK
AI-KSK认证作者
22
68H
更新时间2026-07-14
支持自启动
整合LTX2.3-10Eros v1.4 FP8三套流程,支持图生视频、高质量生成与音频音乐驱动。
整合LTX2.3-10Eros v1.4 FP8三套流程,支持图生视频、高质量生成与音频音乐驱动。
0/小时
Qwen-imageWanLora训练
AiToolKit汉化版
AiToolKit汉化版
146
@Doc_workBox
Doc_workBox认证作者
2246
29119H
更新时间2026-07-17
支持自启动
Aitoolkit汉化版,自适应UI方便手机端查看训练进度
Aitoolkit汉化版,自适应UI方便手机端查看训练进度
0/小时
ComfyUI图片编辑图片生成
Anima-Turbo,支持中文提示词,4步采样,文生图,图像修改,6G显存可用,批量任务,支持50系
Anima-Turbo,支持中文提示词,4步采样,文生图,图像修改,6G显存可用,批量任务,支持50系
1
@刘悦的技术博客
刘悦的技术博客认证作者
2
0H
更新时间2026-07-10
支持自启动
Anima-Turbo,支持中文提示词,4步采样,文生图,图像修改,6G显存可用,批量任务,支持50系
Anima-Turbo,支持中文提示词,4步采样,文生图,图像修改,6G显存可用,批量任务,支持50系
0/小时
ComfyUI图片生成Qwen-Image
Anima Omni 动漫插画全能镜像
Anima Omni 动漫插画全能镜像
6
@AI-KSK
AI-KSK认证作者
32
20H
更新时间2026-07-09
支持自启动
Anima Omni 动漫插画全能镜像内置20套精选工作流,覆盖基础出图、极速生成、NAG增强、LLLite控制、区域构图、局部重绘、脸手修复、风格混合、高清修复与分块放大。
Anima Omni 动漫插画全能镜像内置20套精选工作流,覆盖基础出图、极速生成、NAG增强、LLLite控制、区域构图、局部重绘、脸手修复、风格混合、高清修复与分块放大。
0/小时
ComfyUIWan视频生成
Wan 2.2 无限制 3.0
Wan 2.2 无限制 3.0
63
@AI-KSK
AI-KSK认证作者
589
1833H
更新时间2026-07-09
支持自启动
集成 SmoothMix T2V 3.0 与 Remix I2V 3.0,支持无限制文本生视频与图生视频创作,兼顾画质、动态、运镜与一致性,适合快速出片与高完成度表达。
集成 SmoothMix T2V 3.0 与 Remix I2V 3.0,支持无限制文本生视频与图生视频创作,兼顾画质、动态、运镜与一致性,适合快速出片与高完成度表达。
0/小时
ComfyUI图片编辑图片生成
Krea-2-GGUF,图像编辑-多图修改,6G显存可用,洗图,文生图,自定义lora,图生图,红潮特化,自动提示词,支持50系,批量任务队列
Krea-2-GGUF,图像编辑-多图修改,6G显存可用,洗图,文生图,自定义lora,图生图,红潮特化,自动提示词,支持50系,批量任务队列
7
@刘悦的技术博客
刘悦的技术博客认证作者
29
75H
更新时间2026-07-09
支持自启动
Krea-2-GGUF,图像编辑-多图修改,6G显存可用,洗图,文生图,自定义lora,图生图,红潮特化,自动提示词,支持50系,批量任务队列
Krea-2-GGUF,图像编辑-多图修改,6G显存可用,洗图,文生图,自定义lora,图生图,红潮特化,自动提示词,支持50系,批量任务队列
0/小时
数字人语音合成视频生成
织梦智能体-数字人合成-语音合成-超级混剪
织梦智能体-数字人合成-语音合成-超级混剪
5
@织梦智能体
40
74H
更新时间2026-07-17
支持自启动
全网最牛逼最便宜的口播智能体,没有之一
全网最牛逼最便宜的口播智能体,没有之一
0/小时
推理框架Qwen文本模型
sglang(0.5.14)和vllm(0.24.0)推理框架镜像-源码安装版本
sglang(0.5.14)和vllm(0.24.0)推理框架镜像-源码安装版本
1
@lv
0
0H
更新时间2026-07-17
sglang和vllm两个推理框架的镜像,切换环境即可,用源码安装的可以随便更换版本
sglang和vllm两个推理框架的镜像,切换环境即可,用源码安装的可以随便更换版本
0.5/小时
ComfyUIWan视频生成
Wan2.2-ReMixV3.0
Wan2.2-ReMixV3.0
54
@刘悦的技术博客
刘悦的技术博客认证作者
393
750H
更新时间2026-07-07
支持自启动
Wan2.2-ReMixV3.0-SVI2-VBVR,文生视频,图生视频,无限时长,首尾帧,自动补帧,自适应端口号,支持50系,支持批量任务
Wan2.2-ReMixV3.0-SVI2-VBVR,文生视频,图生视频,无限时长,首尾帧,自动补帧,自适应端口号,支持50系,支持批量任务
0/小时
ComfyUILTX视频生成
LTX-2.3-10Eros-V1.3-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-10Eros-V1.3-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
4
@刘悦的技术博客
刘悦的技术博客认证作者
19
36H
更新时间2026-07-17
支持自启动
LTX-2.3-10Eros-V1.3-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-10Eros-V1.3-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
SVC
SVC-Fusion_api_rvc
SVC-Fusion_api_rvc
1
@杭州
2618
2484H
更新时间2026-07-17
支持自启动
支持了rvc模型算法的SVC-Fusion_api
支持了rvc模型算法的SVC-Fusion_api
0/小时
FluxWanComfyUI
Bob同学的comfyui云端镜像系列
Bob同学的comfyui云端镜像系列
436
@Bob同学
Bob同学认证作者
6907
24883H
更新时间2026-07-17
支持自启动
此版本内置 (Wan2.2\Flux\Kontext)系列的全部基础模型及工作流
此版本内置 (Wan2.2\Flux\Kontext)系列的全部基础模型及工作流
0/小时
ComfyUILTX视频生成
ComfyUI
ComfyUI
12
@Time-AI
Time-AI认证作者
137
501H
更新时间2026-07-17
支持自启动
LTX2.3导演台2.0全整合视频,包括文生视频、图生视频、音频视频、首尾帧视频、视频输入续写、去字幕、嘴型编辑、beta局部片段编辑;动漫模型anima,包括文生图、contorlnet生图,局部修复和特化局部修复
LTX2.3导演台2.0全整合视频,包括文生视频、图生视频、音频视频、首尾帧视频、视频输入续写、去字幕、嘴型编辑、beta局部片段编辑;动漫模型anima,包括文生图、contorlnet生图,局部修复和特化局部修复
0/小时
ComfyUI图片生成Lora训练
Aitookit_krea2_lora_training
Aitookit_krea2_lora_training
7
@有趣的80后程序员
有趣的80后程序员认证作者
33
205H
更新时间2026-07-17
支持自启动
Krea2 Lora 训练镜像,包含模型,数据集以及一次训练结果
Krea2 Lora 训练镜像,包含模型,数据集以及一次训练结果
0/小时
ComfyUI图片生成图片编辑
二次元游戏立绘表情拆分姿势制作VNCSS
二次元游戏立绘表情拆分姿势制作VNCSS
2
@梦影Erislia
18
28H
更新时间2026-07-17
二次元游戏立绘表情拆分姿势制作VNCSS
二次元游戏立绘表情拆分姿势制作VNCSS
0/小时
ComfyUI图片生成
RedCraft-Krea-2-GGUF,红潮特化,洗图,文生图,自定义lora,图生图,自定义提示词,8G显存可用,支持50系,批量任务队列
RedCraft-Krea-2-GGUF,红潮特化,洗图,文生图,自定义lora,图生图,自定义提示词,8G显存可用,支持50系,批量任务队列
2
@刘悦的技术博客
刘悦的技术博客认证作者
38
41H
更新时间2026-07-17
支持自启动
RedCraft-Krea-2-GGUF,红潮特化,洗图,文生图,自定义lora,图生图,自定义提示词,8G显存可用,支持50系,批量任务队列
RedCraft-Krea-2-GGUF,红潮特化,洗图,文生图,自定义lora,图生图,自定义提示词,8G显存可用,支持50系,批量任务队列
0/小时
其他
sora2文生视频、图生视频工作流
sora2文生视频、图生视频工作流
107
@鸡你太美
鸡你太美认证作者
427
1932H
更新时间2026-07-17
支持自启动
修改img-all六分钱模型香蕉出图模型生成报错问题
修改img-all六分钱模型香蕉出图模型生成报错问题
0/小时
图片生成图片编辑
免费版GPT-Image2,Krea2高质量版,超强图片细节美感!图生图洗图 | 高清放大 | 支持LoRA
免费版GPT-Image2,Krea2高质量版,超强图片细节美感!图生图洗图 | 高清放大 | 支持LoRA
7
@与AI同行
与AI同行认证作者
51
34H
更新时间2026-07-16
支持自启动
免费版GPT-Image2,Krea2高质量版,超强图片细节美感!生图洗图 | 高清放大 | 支持LoRA
免费版GPT-Image2,Krea2高质量版,超强图片细节美感!生图洗图 | 高清放大 | 支持LoRA
0/小时
语音合成Qwen3-TTSAI电商
【VoxCPM2/Qwen3TTS/IndexTTS2/OmniVoice】N合一AI语音整合TTS ALL in ONE
【VoxCPM2/Qwen3TTS/IndexTTS2/OmniVoice】N合一AI语音整合TTS ALL in ONE
105
@淼淼爸的ai笔记
淼淼爸的ai笔记认证作者
1446
9326H
更新时间2026-07-16
支持自启动
本镜像专为AI语音直播项目打造,也可以直接在线推理webui使用,集成VoxCPM2/IndexTTS-2等, 支持API调用,直播带货,tiktok直播,在线克隆,语气语调自然,音色还原度高
本镜像专为AI语音直播项目打造,也可以直接在线推理webui使用,集成VoxCPM2/IndexTTS-2等, 支持API调用,直播带货,tiktok直播,在线克隆,语气语调自然,音色还原度高
0/小时
ComfyUI图片生成图片编辑
Boogu-Image-fix-4step,文生图,图像修改,8G显存可用,支持50系,批量任务队列
Boogu-Image-fix-4step,文生图,图像修改,8G显存可用,支持50系,批量任务队列
1
@刘悦的技术博客
刘悦的技术博客认证作者
20
37H
更新时间2026-07-16
支持自启动
Boogu-Image-fix-4step,文生图,图像修改,8G显存可用,支持50系,批量任务队列
Boogu-Image-fix-4step,文生图,图像修改,8G显存可用,支持50系,批量任务队列
0/小时
文本模型
长篇小说&有声小说工作站
长篇小说&有声小说工作站
1
@IAI666
2
0H
更新时间2026-07-15
支持自启动
AI驱动的长篇小说创作与有声书生成工作站,支持大纲管理、角色系统、AI续写、质量审阅和语音合成全流程。
AI驱动的长篇小说创作与有声书生成工作站,支持大纲管理、角色系统、AI续写、质量审阅和语音合成全流程。
0.1/小时
语音合成
VoxCPM2  ONNX版本
VoxCPM2 ONNX版本
2
@雨落实战
雨落实战认证作者
25
8H
更新时间2026-07-15
支持自启动
VoxCPM2 ONNX加速版
VoxCPM2 ONNX加速版
0/小时
语音合成AI音乐
RVC-WebUI
RVC-WebUI
19
@乔大峰
乔大峰认证作者
269
1094H
更新时间2026-07-14
RVC-WebUI网页端训练镜像支持RVC/Replay翻唱模型/变声器
RVC-WebUI网页端训练镜像支持RVC/Replay翻唱模型/变声器
0/小时
目标检测
ultralytics
ultralytics
2
@muyulin
2
15H
更新时间2026-06-29
Ultralytics模型基于深度学习和计算机视觉其精简的设计,该镜像可以实现YOLOv8,YOLOv9,YOLOv10,YOLOv11,YOlOv26模型的应用
Ultralytics模型基于深度学习和计算机视觉其精简的设计,该镜像可以实现YOLOv8,YOLOv9,YOLOv10,YOLOv11,YOlOv26模型的应用
0/小时
ComfyUI图片生成图片编辑
Krea-2-GGUF,洗图,文生图,自定义lora,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
Krea-2-GGUF,洗图,文生图,自定义lora,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
5
@刘悦的技术博客
刘悦的技术博客认证作者
75
53H
更新时间2026-06-28
支持自启动
Krea-2-GGUF,洗图,文生图,自定义lora,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
Krea-2-GGUF,洗图,文生图,自定义lora,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
0/小时
视频生成视频编辑
最强视频替换人物&动作迁移,Scail2合集,超强效果 | 超长视频生成 | 批量生成 | 爆款视频复刻
最强视频替换人物&动作迁移,Scail2合集,超强效果 | 超长视频生成 | 批量生成 | 爆款视频复刻
43
@与AI同行
与AI同行认证作者
461
1379H
更新时间2026-06-27
支持自启动
最强视频替换人物&动作迁移,Scail2合集,超强效果 | 超长视频生成 | 批量生成 | 爆款视频复刻
最强视频替换人物&动作迁移,Scail2合集,超强效果 | 超长视频生成 | 批量生成 | 爆款视频复刻
0/小时
AI漫剧数字人ComfyUI
202604全新ComfyUI整合包,主流模型都有,附带40个实用工作流,体积不到100G
202604全新ComfyUI整合包,主流模型都有,附带40个实用工作流,体积不到100G
92
@老徐Ai研习社
老徐Ai研习社认证作者
987
5936H
更新时间2026-06-27
支持自启动
ComfyUI整合包20260506
ComfyUI整合包20260506
0/小时
生物信息分子动力
ESMFold
ESMFold
0
@苍耳阿猫
苍耳阿猫认证作者
0
0H
更新时间2026-06-29
ESMFold
ESMFold
0/小时
ComfyUI图片生成
Ideogram-4-Single,单模型8步采样,单提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,支持50系
Ideogram-4-Single,单模型8步采样,单提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,支持50系
0
@刘悦的技术博客
刘悦的技术博客认证作者
19
16H
更新时间2026-06-26
支持自启动
Ideogram-4-Single,单模型8步采样,单提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,支持50系
Ideogram-4-Single,单模型8步采样,单提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,支持50系
0/小时
数字人视频生成语音合成
OpenTalking
OpenTalking
5
@Opentalking
103
244H
更新时间2026-07-09
支持自启动
OpenTalking 是一个面向实时数字人对话与应用开发的开源平台,用统一的 WebUI、知识库、语音、模型运行时和部署链路,把数字人从单次演示连接成可落地的应用系统。
OpenTalking 是一个面向实时数字人对话与应用开发的开源平台,用统一的 WebUI、知识库、语音、模型运行时和部署链路,把数字人从单次演示连接成可落地的应用系统。
0/小时
ComfyUILTX视频生成
LTX2.3-Director-v2最新版-完美去除视频字幕的导演工作流
LTX2.3-Director-v2最新版-完美去除视频字幕的导演工作流
7
@匹夫
匹夫认证作者
29
63H
更新时间2026-06-25
LTX2.3-Director-v2最新版-完美去除视频字幕的导演工作流
LTX2.3-Director-v2最新版-完美去除视频字幕的导演工作流
0/小时
ComfyUILTX视频生成
KSK LTX2.3 3.5满血整合镜像|22B视频创作套件
KSK LTX2.3 3.5满血整合镜像|22B视频创作套件
10
@AI-KSK
AI-KSK认证作者
55
58H
更新时间2026-06-26
支持自启动
基于 ComfyUI 深度整合的 LTX2.3 3.5 满血镜像,内置 22B 主模型、插件依赖与多套核心工作流,支持文生视频、图生视频、数字人、分镜控制和视频增强,真正做到开箱即用。
基于 ComfyUI 深度整合的 LTX2.3 3.5 满血镜像,内置 22B 主模型、插件依赖与多套核心工作流,支持文生视频、图生视频、数字人、分镜控制和视频增强,真正做到开箱即用。
0/小时
ComfyUI图片生成Flux
Krea2 Turbo Engine|ComfyUI 本地加速镜像
Krea2 Turbo Engine|ComfyUI 本地加速镜像
1
@AI-KSK
AI-KSK认证作者
35
78H
更新时间2026-06-24
支持自启动
基于 Krea 2 Turbo 的本地化 ComfyUI 推理环境,优化生成速度与稳定性,适用于高频文生图与风格测试。
基于 Krea 2 Turbo 的本地化 ComfyUI 推理环境,优化生成速度与稳定性,适用于高频文生图与风格测试。
0/小时
ComfyUI图片生成
Krea-2-GGUF,文生图,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
Krea-2-GGUF,文生图,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
0
@刘悦的技术博客
刘悦的技术博客认证作者
29
18H
更新时间2026-06-24
支持自启动
Krea-2-GGUF,文生图,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
Krea-2-GGUF,文生图,图生图,No-Safety-Filter,8G显存可用,支持50系,批量任务队列
0/小时
语音合成语音分离语音识别
dots.tts语音克隆视频配音平台
dots.tts语音克隆视频配音平台
4
@K哥讲AI
K哥讲AI认证作者
16
110H
更新时间2026-06-23
支持自启动
dots.tts语音克隆视频配音平台
dots.tts语音克隆视频配音平台
0/小时
Lora训练图片生成图片编辑
Boogu Image的lora训练AI-TOOLKIT
Boogu Image的lora训练AI-TOOLKIT
1
@梦影Erislia
8
17H
更新时间2026-06-22
Boogu Image的lora训练AI-TOOLKIT
Boogu Image的lora训练AI-TOOLKIT
0/小时
数字人ComfyUI
ComfyUI云端整合包2506
ComfyUI云端整合包2506
0
@鹄仙
鹄仙认证作者
25
38H
更新时间2026-06-26
ComfyUI云端整合包2606
ComfyUI云端整合包2606
0/小时
ComfyUI图片编辑图片生成
Boogu-Image-GGUF,文生图,图像修改,8G显存可用,支持50系,批量任务队列
Boogu-Image-GGUF,文生图,图像修改,8G显存可用,支持50系,批量任务队列
1
@刘悦的技术博客
刘悦的技术博客认证作者
40
52H
更新时间2026-06-21
支持自启动
Boogu-Image-GGUF,文生图,图像修改,8G显存可用,支持50系,批量任务队列
Boogu-Image-GGUF,文生图,图像修改,8G显存可用,支持50系,批量任务队列
0/小时
AI应用语音合成
专业级Seed-TTS-Eval语音评测工具
专业级Seed-TTS-Eval语音评测工具
1
@雨落实战
雨落实战认证作者
7
1H
更新时间2026-06-22
支持自启动
这是一个用于评测TTS语音质量的工具
这是一个用于评测TTS语音质量的工具
0/小时
3D生成
单图生成3D高斯文件,TripoSplat,超强3D效果!游戏3D | AR/VR | 3D资产创作 | 批量生成
单图生成3D高斯文件,TripoSplat,超强3D效果!游戏3D | AR/VR | 3D资产创作 | 批量生成
4
@与AI同行
与AI同行认证作者
13
3H
更新时间2026-06-19
支持自启动
单图生成3D高斯文件,TripoSplat,超强3D效果!游戏3D | AR/VR | 3D资产创作 | 批量生成
单图生成3D高斯文件,TripoSplat,超强3D效果!游戏3D | AR/VR | 3D资产创作 | 批量生成
0/小时
语音合成IndexTTSAI应用
新一代高质量语音生成模型VoxCPM 2.0 整合包升级了, 支持 30 种语言、9 种中文方言!
新一代高质量语音生成模型VoxCPM 2.0 整合包升级了, 支持 30 种语言、9 种中文方言!
14
@余子越Talk
余子越Talk认证作者
167
607H
更新时间2026-06-19
支持自启动
是 VoxCPM 系列的新一代语音生成模型,基于 2B 参数规模,并使用超过 200 万小时的多语言语音数据训练,支持 30 种语言、9 种中文方言
是 VoxCPM 系列的新一代语音生成模型,基于 2B 参数规模,并使用超过 200 万小时的多语言语音数据训练,支持 30 种语言、9 种中文方言
0/小时
ComfyUI图片生成Lora训练
AnimaBase的Lora融合训练Comfy和Trainer
AnimaBase的Lora融合训练Comfy和Trainer
9
@梦影Erislia
50
143H
更新时间2026-06-18
AnimaBase的Lora融合训练Comfy和Trainer
AnimaBase的Lora融合训练Comfy和Trainer
0/小时
数字人
infinitetakl数字人云端版本
infinitetakl数字人云端版本
12
@pappyai
91
257H
更新时间2026-06-18
支持自启动
infinitetakl数字人,支持单人对口型,双人对口型以及单人视频对口型
infinitetakl数字人,支持单人对口型,双人对口型以及单人视频对口型
0/小时
ComfyUILTX视频生成
JoyAI-Echo-ComfyUI-无损版
JoyAI-Echo-ComfyUI-无损版
4
@有趣的80后程序员
有趣的80后程序员认证作者
9
2H
更新时间2026-06-18
支持自启动
JoyAI-Echo的comfyUI版本,全量模型无损版
JoyAI-Echo的comfyUI版本,全量模型无损版
0/小时
ComfyUI图片生成图片编辑
Ideogram-4-GGUF,自动提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
Ideogram-4-GGUF,自动提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
1
@刘悦的技术博客
刘悦的技术博客认证作者
21
5H
更新时间2026-06-18
支持自启动
Ideogram-4-GGUF,自动提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
Ideogram-4-GGUF,自动提示词,图生图,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
0/小时
数字人CosyVoiceDeepSeek
数字人直播
数字人直播
5
@AI开发日记
53
94H
更新时间2026-06-25
支持自启动
数字人直播
数字人直播
0.5/小时
语音合成
VoxCPM2 声音克隆系统webui开机即用
VoxCPM2 声音克隆系统webui开机即用
0
@鸡你太美
鸡你太美认证作者
33
7H
更新时间2026-06-18
支持自启动
VoxCPM2 声音克隆系统webui开机即用
VoxCPM2 声音克隆系统webui开机即用
0/小时
ComfyUI视频生成视频编辑
SCAIL2-那颗星星自制工作流,动作迁移,人物替换,可以直出长视频
SCAIL2-那颗星星自制工作流,动作迁移,人物替换,可以直出长视频
9
@那颗星星
178
401H
更新时间2026-06-16
支持自启动
自制SCAIL2 ComfyUI工作流,可以动作迁移,人物替换,可以直出长视频,并且我大幅简化了流程,十分简单易用
自制SCAIL2 ComfyUI工作流,可以动作迁移,人物替换,可以直出长视频,并且我大幅简化了流程,十分简单易用
0/小时
IndexTTS语音合成AI应用
indextts-2.0 升级版,影视配音,情绪小短片,情绪精准控制!
indextts-2.0 升级版,影视配音,情绪小短片,情绪精准控制!
37
@余子越Talk
余子越Talk认证作者
450
1027H
更新时间2026-06-15
支持自启动
支持8个角色配音,速度控制,高精度的SRT字幕同步生成,SRT字幕生成配音,情绪控制,海量预设音色列表,语速可调,多音字,专业术语控制。
支持8个角色配音,速度控制,高精度的SRT字幕同步生成,SRT字幕生成配音,情绪控制,海量预设音色列表,语速可调,多音字,专业术语控制。
0/小时
Wan视频生成视频编辑
Bernini-Diffusers满血版|MLLM语义规划视频生成编辑WebUI镜像
Bernini-Diffusers满血版|MLLM语义规划视频生成编辑WebUI镜像
4
@AI-KSK
AI-KSK认证作者
50
59H
更新时间2026-06-15
支持自启动
完整Bernini-Diffusers满血版,内置中文WebUI,保留MLLM语义规划能力,支持AI视频生成、视频编辑与参考图驱动。
完整Bernini-Diffusers满血版,内置中文WebUI,保留MLLM语义规划能力,支持AI视频生成、视频编辑与参考图驱动。
0/小时
语音合成
TTS集合1688——客户定制
TTS集合1688——客户定制
0
@是你k哥啊
19
712H
更新时间2026-06-16
TTS集合
TTS集合
0/小时
ComfyUIZ-Image
Zit-Turbo-Engineer-V6,文生图,图生图,洗图,6G显存可用,局部重绘,支持50系,批量任务队列
Zit-Turbo-Engineer-V6,文生图,图生图,洗图,6G显存可用,局部重绘,支持50系,批量任务队列
4
@刘悦的技术博客
刘悦的技术博客认证作者
45
38H
更新时间2026-06-15
支持自启动
Zit-Turbo-Engineer-V6,文生图,图生图,洗图,6G显存可用,局部重绘,支持50系,批量任务队列
Zit-Turbo-Engineer-V6,文生图,图生图,洗图,6G显存可用,局部重绘,支持50系,批量任务队列
0/小时
ComfyUI视频生成
Scail2角色替换Scail2动作迁移低显存无限时长ComfyUI工作流
Scail2角色替换Scail2动作迁移低显存无限时长ComfyUI工作流
9
@鸡你太美
鸡你太美认证作者
130
379H
更新时间2026-06-15
支持自启动
Scail2角色替换Scail2动作迁移低显存无限时长ComfyUI工作流
Scail2角色替换Scail2动作迁移低显存无限时长ComfyUI工作流
0/小时
数字人AI音乐LTX
LTX2.3一键整合包,数字人对口型,AI唱歌,首尾帧,图生视频,文生视频,图片编辑,文生图,支持50系显卡,8G显存可用,64G内存。
LTX2.3一键整合包,数字人对口型,AI唱歌,首尾帧,图生视频,文生视频,图片编辑,文生图,支持50系显卡,8G显存可用,64G内存。
9
@余子越Talk
余子越Talk认证作者
198
414H
更新时间2026-06-15
支持自启动
无需任何配置,一键运行 LTX2.3 数字人 镜像,然后通过公网IP访问生成服务。
无需任何配置,一键运行 LTX2.3 数字人 镜像,然后通过公网IP访问生成服务。
0/小时
Lora训练图片生成其他
Ideogram4的Lora训练AI-Toolkit
Ideogram4的Lora训练AI-Toolkit
0
@梦影Erislia
17
108H
更新时间2026-06-13
Ideogram4的Lora训练AI-Toolkit
Ideogram4的Lora训练AI-Toolkit
0/小时
ComfyUI视频编辑视频生成
Scail-2,视频动作迁移,目标替换,指定目标替换,多人迁移,8G显存可用,支持50系
Scail-2,视频动作迁移,目标替换,指定目标替换,多人迁移,8G显存可用,支持50系
12
@刘悦的技术博客
刘悦的技术博客认证作者
115
227H
更新时间2026-06-12
支持自启动
Scail-2,视频动作迁移,目标替换,指定目标替换,多人迁移,8G显存可用,支持50系
Scail-2,视频动作迁移,目标替换,指定目标替换,多人迁移,8G显存可用,支持50系
0/小时
其他
oac
oac
0
@lxg
0
0H
更新时间2026-06-18
支持自启动
实时数字人
实时数字人
0/小时
ComfyUI图片生成
 Ideogram-4-GGUF,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
Ideogram-4-GGUF,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
4
@刘悦的技术博客
刘悦的技术博客认证作者
36
23H
更新时间2026-06-10
支持自启动
Ideogram-4-GGUF,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
Ideogram-4-GGUF,文生图,8G显存可用,No-Safety-Filter,批量任务,Lora使用,支持50系
0/小时
ComfyUIWan视频生成
AI跳舞矩阵批量镜像:人物图像×舞蹈动作,一键组合自动执行
AI跳舞矩阵批量镜像:人物图像×舞蹈动作,一键组合自动执行
10
@AI-KSK
AI-KSK认证作者
52
421H
更新时间2026-06-11
支持自启动
AI跳舞矩阵镜像,支持人物图像×舞蹈动作一键配对,批量生成冷启动测试素材。
AI跳舞矩阵镜像,支持人物图像×舞蹈动作一键配对,批量生成冷启动测试素材。
0/小时
语音合成IndexTTSAI应用
小红书 AI 语音 dots.tts 开源 48kHz 高保真语音生成,停顿断句自然,支持50系显卡。
小红书 AI 语音 dots.tts 开源 48kHz 高保真语音生成,停顿断句自然,支持50系显卡。
12
@余子越Talk
余子越Talk认证作者
222
575H
更新时间2026-06-15
支持自启动
dots.tts 拥有约 20 亿参数规模,支持零样本声音克隆、高保真语音生成以及自然的情感表达。多个权威榜单 SOTA:Seed-TTS-Eval 平均表现最佳
dots.tts 拥有约 20 亿参数规模,支持零样本声音克隆、高保真语音生成以及自然的情感表达。多个权威榜单 SOTA:Seed-TTS-Eval 平均表现最佳
0/小时
AI应用
comfyui_纯净_2.12-13
comfyui_纯净_2.12-13
1
@kmkm99
7
0H
更新时间2026-06-08
支持自启动
纯净版本的comfyui
纯净版本的comfyui
0/小时
视频生成视频编辑
开源版Google Omni!Bernini视频万物编辑,视频元素添加+删除+修改 | 视频消除物体 | 换背景 | 视频插入视频 | 风格转换 | 支持参考视频+多参考图
开源版Google Omni!Bernini视频万物编辑,视频元素添加+删除+修改 | 视频消除物体 | 换背景 | 视频插入视频 | 风格转换 | 支持参考视频+多参考图
19
@与AI同行
与AI同行认证作者
122
208H
更新时间2026-06-08
支持自启动
开源版Google Omni!Bernini视频万物编辑,视频元素添加+删除+修改 | 视频消除物体 | 换背景 | 视频插入视频 | 风格转换 | 支持参考视频+多参考图
开源版Google Omni!Bernini视频万物编辑,视频元素添加+删除+修改 | 视频消除物体 | 换背景 | 视频插入视频 | 风格转换 | 支持参考视频+多参考图
0/小时
语音合成IndexTTSAI应用
PilotTTS 高德开源语音克隆,8G显存可用,支持 11 种情感、14 种方言的 LLM TTS 系统
PilotTTS 高德开源语音克隆,8G显存可用,支持 11 种情感、14 种方言的 LLM TTS 系统
0
@余子越Talk
余子越Talk认证作者
38
125H
更新时间2026-06-15
支持自启动
PilotTTS 是一套基于大语言模型的开源 TTS 系统,核心特点是"有意简化的架构 + 严格的数据工程"。它提供完全开源的数据处理流水线,支持零样本音色克隆。
PilotTTS 是一套基于大语言模型的开源 TTS 系统,核心特点是"有意简化的架构 + 严格的数据工程"。它提供完全开源的数据处理流水线,支持零样本音色克隆。
0/小时
ComfyUI图片生成
Ideogram-4,文生图,细化描述,至少需要14G显存,批量任务,支持50系
Ideogram-4,文生图,细化描述,至少需要14G显存,批量任务,支持50系
1
@刘悦的技术博客
刘悦的技术博客认证作者
24
166H
更新时间2026-06-08
支持自启动
Ideogram-4,文生图,细化描述,至少需要14G显存,批量任务,支持50系
Ideogram-4,文生图,细化描述,至少需要14G显存,批量任务,支持50系
0/小时
语音合成CosyVoice
PilotTTS,TTS语音模型,情绪控制,接口api使用,8G显存可用,速度1比1,支持超长文本,声音克隆,文本指令
PilotTTS,TTS语音模型,情绪控制,接口api使用,8G显存可用,速度1比1,支持超长文本,声音克隆,文本指令
4
@刘悦的技术博客
刘悦的技术博客认证作者
39
42H
更新时间2026-06-03
支持自启动
PilotTTS,TTS语音模型,情绪控制,接口api使用,8G显存可用,速度1比1,支持超长文本,声音克隆,文本指令
PilotTTS,TTS语音模型,情绪控制,接口api使用,8G显存可用,速度1比1,支持超长文本,声音克隆,文本指令
0/小时
其他
那颗星星自制工作流
那颗星星自制工作流
29
@那颗星星
302
3119H
更新时间2026-06-08
支持自启动
颠覆性设计,真正在ComfyUI内实现无限画布体验
颠覆性设计,真正在ComfyUI内实现无限画布体验
0/小时
ComfyUI图片编辑图片生成
Anima-Base,文生图,图像修改,6G显存可用,批量任务,支持50系
Anima-Base,文生图,图像修改,6G显存可用,批量任务,支持50系
5
@刘悦的技术博客
刘悦的技术博客认证作者
71
114H
更新时间2026-06-01
支持自启动
Anima-Base,文生图,图像修改,6G显存可用,批量任务,支持50系
Anima-Base,文生图,图像修改,6G显存可用,批量任务,支持50系
0/小时
ComfyUI图片生成
Lens-Turbo,文生图,图生图,至少需要12G显存,批量任务,支持50系
Lens-Turbo,文生图,图生图,至少需要12G显存,批量任务,支持50系
2
@刘悦的技术博客
刘悦的技术博客认证作者
30
31H
更新时间2026-05-30
支持自启动
Lens-Turbo,文生图,图生图,至少需要12G显存,批量任务,支持50系
Lens-Turbo,文生图,图生图,至少需要12G显存,批量任务,支持50系
0/小时
语音合成AI应用
MOSS-TTS-v1.5 音色克隆,文字转语音TTS,效果非常稳定,相似度高,支持30种语言,精准控制停顿,拼音,长参考音频+短目标文本的克隆更可靠!
MOSS-TTS-v1.5 音色克隆,文字转语音TTS,效果非常稳定,相似度高,支持30种语言,精准控制停顿,拼音,长参考音频+短目标文本的克隆更可靠!
19
@余子越Talk
余子越Talk认证作者
391
1364H
更新时间2026-06-15
支持自启动
支持任意时刻停顿:用户可以在文本中插入类似 [pause 3.2s] 的标记,精确控制语音中的停顿时长。更稳定的音色克隆.
支持任意时刻停顿:用户可以在文本中插入类似 [pause 3.2s] 的标记,精确控制语音中的停顿时长。更稳定的音色克隆.
0/小时
AI音乐AI应用SVC
SVC-Fusion_api
SVC-Fusion_api
4
@aiguoliuguo
aiguoliuguo认证作者
190
940H
更新时间2026-05-29
支持自启动
SVC Fusion-api服务端
SVC Fusion-api服务端
0/小时
视频生成
超强AI生成视频,Wan2.2 Remix-V3,效果优质!图生视频 | 首尾帧视频 | 高清放大 | 视频插帧 | 批量生成
超强AI生成视频,Wan2.2 Remix-V3,效果优质!图生视频 | 首尾帧视频 | 高清放大 | 视频插帧 | 批量生成
37
@与AI同行
与AI同行认证作者
26
60H
更新时间2026-05-29
支持自启动
超强AI生成视频,Wan2.2 Remix-V3,效果优质!图生视频 | 首尾帧视频 | 高清放大 | 视频插帧 | 批量生成
超强AI生成视频,Wan2.2 Remix-V3,效果优质!图生视频 | 首尾帧视频 | 高清放大 | 视频插帧 | 批量生成
0/小时
ComfyUILTX视频生成
LTX2.3 10Eros 图生视频双工作流:相似度保持 + 分块增强,一张图生成更稳更清晰的视频
LTX2.3 10Eros 图生视频双工作流:相似度保持 + 分块增强,一张图生成更稳更清晰的视频
22
@AI-KSK
AI-KSK认证作者
184
811H
更新时间2026-06-11
支持自启动
LTX2.3 10Eros 图生视频双工作流,支持相似度保持与分块增强,一张图生成更稳、更清晰的视频。
LTX2.3 10Eros 图生视频双工作流,支持相似度保持与分块增强,一张图生成更稳、更清晰的视频。
0/小时
LongCat图片生成图片编辑
LongCat-Image-Edit-Turbo,文生图,图生图,局部重绘,4k超分,批量任务,支持50系
LongCat-Image-Edit-Turbo,文生图,图生图,局部重绘,4k超分,批量任务,支持50系
10
@刘悦的技术博客
刘悦的技术博客认证作者
98
47H
更新时间2026-05-28
支持自启动
LongCat-Image-Edit-Turbo,文生图,图生图,局部重绘,4k超分,批量任务,支持50系
LongCat-Image-Edit-Turbo,文生图,图生图,局部重绘,4k超分,批量任务,支持50系
0/小时
ComfyUI
RUIQILI_COMFYUI
RUIQILI_COMFYUI
7
@李睿琪
171
745H
更新时间2026-06-01
支持自启动
建筑模型 ComfyUI
建筑模型 ComfyUI
0/小时
数字人AI电商ComfyUI
20260527ComfyUI全能整合包
20260527ComfyUI全能整合包
16
@老徐Ai研习社
老徐Ai研习社认证作者
183
1504H
更新时间2026-05-30
支持自启动
20260527ComfyUI全能整合包
20260527ComfyUI全能整合包
0/小时
AI音乐AI应用AI漫剧
StableAudio3
StableAudio3
2
@余子越Talk
余子越Talk认证作者
18
45H
更新时间2026-06-15
支持自启动
Stability AI 开源新王炸 Stable-Audio-3, 音效和纯音乐生成,4G显存可用,支持纯CPU,支持中文提示词!
Stability AI 开源新王炸 Stable-Audio-3, 音效和纯音乐生成,4G显存可用,支持纯CPU,支持中文提示词!
0/小时
ComfyUIWan
ComfyUI纯净版,集成wan2.2图生视频
ComfyUI纯净版,集成wan2.2图生视频
0
@
19
35H
更新时间2026-05-28
支持自启动
小白初学入门,纯净官方无冗余,详细看介绍
小白初学入门,纯净官方无冗余,详细看介绍
0.15/小时
ComfyUILTX图片编辑
Comfy打开即用LTX2.3Dasiwa视频生成qwen图像编辑
Comfy打开即用LTX2.3Dasiwa视频生成qwen图像编辑
18
@梦影Erislia
160
421H
更新时间2026-05-25
Comfy打开即用LTX2.3Dasiwa视频生成qwen图像编辑
Comfy打开即用LTX2.3Dasiwa视频生成qwen图像编辑
0/小时
视频生成
LongCat-Video-1.5来自美团最新开源视频模型文生视频图生视频数字人视频webui
LongCat-Video-1.5来自美团最新开源视频模型文生视频图生视频数字人视频webui
7
@鸡你太美
鸡你太美认证作者
60
128H
更新时间2026-05-24
LongCat-Video-1.5来自美团最新开源视频模型文生视频图生视频数字人视频webui
LongCat-Video-1.5来自美团最新开源视频模型文生视频图生视频数字人视频webui
0/小时
数字人LTX视频生成
LTX-2.3-OmniNFT-文图生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
LTX-2.3-OmniNFT-文图生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
14
@刘悦的技术博客
刘悦的技术博客认证作者
115
154H
更新时间2026-05-23
支持自启动
LTX-2.3-OmniNFT-文图生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
LTX-2.3-OmniNFT-文图生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
0/小时
视频生成LongCat数字人
LongCat Avatar 1.5|WebUI 无限时长数字人镜像
LongCat Avatar 1.5|WebUI 无限时长数字人镜像
12
@AI-KSK
AI-KSK认证作者
93
251H
更新时间2026-05-24
支持自启动
内置简易 WebUI,支持 6 种运行方式,主打高清数字人长视频生成。480P 可用 48G 显卡运行,720P 建议更高规格 GPU,适合低中断率超长视频制作。
内置简易 WebUI,支持 6 种运行方式,主打高清数字人长视频生成。480P 可用 48G 显卡运行,720P 建议更高规格 GPU,适合低中断率超长视频制作。
0/小时
语音合成
超强TTS情感控制VoxCPM云端API接口
超强TTS情感控制VoxCPM云端API接口
2
@河狸配音工坊
26
333H
更新时间2026-06-09
支持自启动
超强TTS情感控制VoxCPM云端API接口
超强TTS情感控制VoxCPM云端API接口
0/小时
视频生成
来自英伟达的长视频开源解决方案LongLive 2.0 WebUI
来自英伟达的长视频开源解决方案LongLive 2.0 WebUI
2
@鸡你太美
鸡你太美认证作者
4
1H
更新时间2026-05-23
支持自启动
来自英伟达的长视频开源解决方案LongLive 2.0 WebUI
来自英伟达的长视频开源解决方案LongLive 2.0 WebUI
0/小时
Lora训练
Animal Lora训练器 附详细说明
Animal Lora训练器 附详细说明
9
@野生技能师
30
133H
更新时间2026-05-25
Animal Lora训练器,有训练设置的详细说明
Animal Lora训练器,有训练设置的详细说明
0/小时
语音合成AI音乐
Stable-Audio-3,声音生成,4G显存可用,支持纯CPU,支持中文提示词,接口API调用,ASMR助眠,文字生成声音和音乐,支持老显卡,支持50系
Stable-Audio-3,声音生成,4G显存可用,支持纯CPU,支持中文提示词,接口API调用,ASMR助眠,文字生成声音和音乐,支持老显卡,支持50系
4
@刘悦的技术博客
刘悦的技术博客认证作者
14
10H
更新时间2026-05-22
支持自启动
Stable-Audio-3,声音生成,4G显存可用,支持纯CPU,支持中文提示词,接口API调用,ASMR助眠,文字生成声音和音乐,支持老显卡,支持50系
Stable-Audio-3,声音生成,4G显存可用,支持纯CPU,支持中文提示词,接口API调用,ASMR助眠,文字生成声音和音乐,支持老显卡,支持50系
0/小时
ComfyUI图片生成Lora训练
Anima LoRA 批量炼丹工厂
Anima LoRA 批量炼丹工厂
13
@AI-KSK
AI-KSK认证作者
144
424H
更新时间2026-05-22
支持自启动
内置 AnimaForge 批量 LoRA 训练插件,支持自动打标、Caption 清洗、触发词保护与批量训练。
内置 AnimaForge 批量 LoRA 训练插件,支持自动打标、Caption 清洗、触发词保护与批量训练。
0/小时
混元3D生成其他
混元World模型Mirror
混元World模型Mirror
2
@梦影Erislia
6
5H
更新时间2026-05-22
生成3d高斯,法线图等
生成3d高斯,法线图等
0/小时
数字人
羲和AI爆款IP口播智能体
羲和AI爆款IP口播智能体
3
@羲和AI爆款IP口播智能体
50
232H
更新时间2026-05-21
支持自启动
羲和AI爆款IP口播智能体官方团队打造
羲和AI爆款IP口播智能体官方团队打造
0/小时
语音合成SVC
SVC-WebUI
SVC-WebUI
66
@乔大峰
乔大峰认证作者
1506
16663H
更新时间2026-07-14
一键训练SVC模型,支持上传压缩干声文件,训练完成发送提醒,一键清空训练环境,追求的就是高效率
一键训练SVC模型,支持上传压缩干声文件,训练完成发送提醒,一键清空训练环境,追求的就是高效率
0/小时
语音合成LTX
DramaBox,语义化场景描述语音模型,TTS,接口api使用,8G显存可用,文本转语音,语速调节
DramaBox,语义化场景描述语音模型,TTS,接口api使用,8G显存可用,文本转语音,语速调节
3
@刘悦的技术博客
刘悦的技术博客认证作者
15
3H
更新时间2026-05-20
支持自启动
DramaBox,语义化场景描述语音模型,TTS,接口api使用,8G显存可用,文本转语音,语速调节
DramaBox,语义化场景描述语音模型,TTS,接口api使用,8G显存可用,文本转语音,语速调节
0/小时
视频生成
超强AI字幕识别翻译,Captions_Auto_V1,工业级别效果,本地无限生成!音视频字幕识别 | 字幕翻译 | 短视频文案识别
超强AI字幕识别翻译,Captions_Auto_V1,工业级别效果,本地无限生成!音视频字幕识别 | 字幕翻译 | 短视频文案识别
4
@与AI同行
与AI同行认证作者
16
33H
更新时间2026-05-20
支持自启动
超强AI字幕识别翻译,Captions_Auto_V1,工业级别效果,本地无限生成!音视频字幕识别 | 字幕翻译 | 短视频文案识别
超强AI字幕识别翻译,Captions_Auto_V1,工业级别效果,本地无限生成!音视频字幕识别 | 字幕翻译 | 短视频文案识别
0/小时
IndexTTS
Index TTS2长视频配音
Index TTS2长视频配音
2
@
18
15H
更新时间2026-05-20
支持自启动
本镜像是一个基于 IndexTTS2 的中英视频自动配音工具,适合将英文视频或音频批量转换为中文克隆配音。
本镜像是一个基于 IndexTTS2 的中英视频自动配音工具,适合将英文视频或音频批量转换为中文克隆配音。
0.01/小时
视频生成Wan
Wan2.2-ReMix3.0-Relay-Smart-图生视频-文生视频
Wan2.2-ReMix3.0-Relay-Smart-图生视频-文生视频
18
@刘悦的技术博客
刘悦的技术博客认证作者
172
1168H
更新时间2026-05-19
支持自启动
Wan2.2-ReMix3.0-Relay-Smart-图生视频-文生视频
Wan2.2-ReMix3.0-Relay-Smart-图生视频-文生视频
0/小时
ComfyUILTX视频生成
LTX-2.3-Prompt-Relay-Smart-图生视频-多人对话-单人数字人,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
LTX-2.3-Prompt-Relay-Smart-图生视频-多人对话-单人数字人,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
10
@刘悦的技术博客
刘悦的技术博客认证作者
96
438H
更新时间2026-05-16
支持自启动
LTX-2.3-Prompt-Relay-Smart-图生视频-多人对话-单人数字人,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
LTX-2.3-Prompt-Relay-Smart-图生视频-多人对话-单人数字人,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
0/小时
图片生成图片编辑
HiDream-O1 新架构图像生成
HiDream-O1 新架构图像生成
0
@鹄仙
鹄仙认证作者
5
4H
更新时间2026-05-14
新架构2K直出图像模型
新架构2K直出图像模型
0/小时
图片生成图片编辑
hidream-o1-image,文生图,图片编辑,多图编辑,4k超分,批量任务,支持50系
hidream-o1-image,文生图,图片编辑,多图编辑,4k超分,批量任务,支持50系
9
@刘悦的技术博客
刘悦的技术博客认证作者
86
39H
更新时间2026-05-14
支持自启动
hidream-o1-image,文生图,图片编辑,多图编辑,4k超分,批量任务,支持50系
hidream-o1-image,文生图,图片编辑,多图编辑,4k超分,批量任务,支持50系
0/小时
ComfyUILTXInfiniteTalk
官方出手:LTX2.3视频人物一键改台词
官方出手:LTX2.3视频人物一键改台词
5
@AI-KSK
AI-KSK认证作者
39
17H
更新时间2026-05-12
支持自启动
基于 LTX2.3 的视频改台词配音镜像,支持新语音生成、口型同步与说话人风格保留。
基于 LTX2.3 的视频改台词配音镜像,支持新语音生成、口型同步与说话人风格保留。
0/小时
数字人AI漫剧AI电商
ComfyUI-音图视量产-DD布丁AIGC-多人小说配音-短剧-二创-电商
ComfyUI-音图视量产-DD布丁AIGC-多人小说配音-短剧-二创-电商
26
@DD布丁AIGC
109
405H
更新时间2026-05-14
支持自启动
从多人配音到短剧量产,自研节点驱动的 AIGC 工业化终极方案。(这不只是一个装好插件的镜像,这是一套我跑通了千万级流量、踩过无数坑后,沉淀下来的‘生产力闭环’。)
从多人配音到短剧量产,自研节点驱动的 AIGC 工业化终极方案。(这不只是一个装好插件的镜像,这是一套我跑通了千万级流量、踩过无数坑后,沉淀下来的‘生产力闭环’。)
0/小时
图片生成视频生成AI漫剧
Huobao-Drama
Huobao-Drama
31
@huobao-ai
huobao-ai认证作者
158
468H
更新时间2026-05-11
支持自启动
Huobao Drama 是一个基于 AI 的短剧自动化生产平台,实现从剧本生成、角色设计、分镜制作到视频合成的全流程自动化
Huobao Drama 是一个基于 AI 的短剧自动化生产平台,实现从剧本生成、角色设计、分镜制作到视频合成的全流程自动化
0/小时
LTX视频生成ComfyUI
Sulphur-2-GGUF-图生视频-文生视频,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
Sulphur-2-GGUF-图生视频-文生视频,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
16
@刘悦的技术博客
刘悦的技术博客认证作者
206
599H
更新时间2026-05-09
支持自启动
Sulphur-2-GGUF-图生视频-文生视频,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
Sulphur-2-GGUF-图生视频-文生视频,自动补帧,支持50系,自定义分辨率,自适应端口,批量任务队列
0/小时
数字人
ltx2.3图片可控分镜数字人
ltx2.3图片可控分镜数字人
3
@pappyai
6
1H
更新时间2026-06-04
支持自启动
ltx2.3可控分镜图片数字人生成。
ltx2.3可控分镜图片数字人生成。
0/小时
语音识别
准确率极高的离线字幕.SRT生成,带时间轴,下载即可使用
准确率极高的离线字幕.SRT生成,带时间轴,下载即可使用
1
@星尘玩AI
0
0H
更新时间2026-05-20
支持自启动
普通话不标准也能准确率极高的字幕.SRT,带时间轴,下载即可使用,支持中英文
普通话不标准也能准确率极高的字幕.SRT,带时间轴,下载即可使用,支持中英文
0/小时
Qwen
GRPO_qwen2.5_1.5B
GRPO_qwen2.5_1.5B
0
@云龙老师
2
1H
更新时间2026-05-08
通过该镜像可以实现qwen2.5-1.5B的强化学习训练
通过该镜像可以实现qwen2.5-1.5B的强化学习训练
0.1/小时
文本模型数字人行业模型
Gemma-4-26B-A4B-it-Uncensored,8K上下文,AI女友,大语言模型,语音对话,适合甜品卡,支持50系
Gemma-4-26B-A4B-it-Uncensored,8K上下文,AI女友,大语言模型,语音对话,适合甜品卡,支持50系
4
@刘悦的技术博客
刘悦的技术博客认证作者
21
12H
更新时间2026-05-08
支持自启动
Gemma-4-26B-A4B-it-Uncensored,8K上下文,AI女友,大语言模型,语音对话,适合甜品卡,支持50系
Gemma-4-26B-A4B-it-Uncensored,8K上下文,AI女友,大语言模型,语音对话,适合甜品卡,支持50系
0/小时
视频生成Wan
TurboDiffusion清华大学等推出的视频生成加速框架 webUI二次修改构建by科哥
TurboDiffusion清华大学等推出的视频生成加速框架 webUI二次修改构建by科哥
5
@鸡你太美
鸡你太美认证作者
89
67H
更新时间2026-05-08
支持自启动
ai视频生成速度提升百倍!基于wan2.1,wan2.2加速ai优化推理速度
ai视频生成速度提升百倍!基于wan2.1,wan2.2加速ai优化推理速度
0/小时
语音合成
MOSS TTSD 0.7
MOSS TTSD 0.7
1
@super-Z
2
0H
更新时间2026-05-08
MOSS TTSD 0.7,主要用于双人对话生成
MOSS TTSD 0.7,主要用于双人对话生成
0/小时
ComfyUILTX视频生成
Sulphur& 10Eros ltx2.3视频生产解锁镜像
Sulphur& 10Eros ltx2.3视频生产解锁镜像
41
@AI-KSK
AI-KSK认证作者
286
705H
更新时间2026-05-26
支持自启动
Sulphur-10Eros-LTX2.3 解锁视频生产镜像,基于 ComfyUI 搭建,内置 Sulphur Distill BF16、10Eros BF16,支持官方工作流和高自由度私域视频创作。
Sulphur-10Eros-LTX2.3 解锁视频生产镜像,基于 ComfyUI 搭建,内置 Sulphur Distill BF16、10Eros BF16,支持官方工作流和高自由度私域视频创作。
0/小时
AI漫剧Lora训练AI电商
20260506_aitoolkit全能lora模型训练王
20260506_aitoolkit全能lora模型训练王
24
@老徐Ai研习社
老徐Ai研习社认证作者
125
865H
更新时间2026-05-06
支持自启动
aitoolkit全能lora模型训练王
aitoolkit全能lora模型训练王
0/小时
其他
anima炼丹v2
anima炼丹v2
7
@zhanglang
30
176H
更新时间2026-05-08
anima炼丹
anima炼丹
0/小时
ComfyUILTX视频生成
LTX-2.3-10Eros-图生视频-文生视频-多人对话-单人数字人
LTX-2.3-10Eros-图生视频-文生视频-多人对话-单人数字人
12
@刘悦的技术博客
刘悦的技术博客认证作者
142
174H
更新时间2026-05-08
支持自启动
LTX-2.3-10Eros-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-10Eros-图生视频-文生视频-多人对话-单人数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
ComfyUI图片生成图片编辑
Pmaster-v3.5-Turbo,文生图,图生图,洗图
Pmaster-v3.5-Turbo,文生图,图生图,洗图
7
@刘悦的技术博客
刘悦的技术博客认证作者
77
97H
更新时间2026-05-08
支持自启动
Pmaster-v3.5-Turbo,文生图,图生图,洗图,6G显存可用,4k超分,局部重绘,自动提示词,支持50系,批量任务队列
Pmaster-v3.5-Turbo,文生图,图生图,洗图,6G显存可用,4k超分,局部重绘,自动提示词,支持50系,批量任务队列
0/小时
ComfyUI图片生成视频生成
sd2-fast在线使用sedance2.0-fast无须排队高并发api企业框架接口视频生成
sd2-fast在线使用sedance2.0-fast无须排队高并发api企业框架接口视频生成
7
@鸡你太美
鸡你太美认证作者
36
546H
更新时间2026-05-08
支持自启动
任意机器可以运行该项目开机自动运行
任意机器可以运行该项目开机自动运行
0/小时
语音合成IndexTTSQwen3-TTS
声音克隆OmniVoice——600+语言音色克隆 - 音色设计 - 多语言语音生成
声音克隆OmniVoice——600+语言音色克隆 - 音色设计 - 多语言语音生成
16
@星尘玩AI
120
833H
更新时间2026-05-20
支持自启动
支持600+语言音色克隆 - 音色设计 - 多语言语音生成
支持600+语言音色克隆 - 音色设计 - 多语言语音生成
0/小时
数字人LTX视频生成
LTX-2.3-22B-DISTILLED-1.1-VBVR-文生视频-首尾帧,单图无限时长
LTX-2.3-22B-DISTILLED-1.1-VBVR-文生视频-首尾帧,单图无限时长
23
@刘悦的技术博客
刘悦的技术博客认证作者
197
325H
更新时间2026-05-08
支持自启动
LTX-2.3-22B-DISTILLED-1.1-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-22B-DISTILLED-1.1-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
数字人ComfyUILTX
LTX-2.3-22B-DISTILLED-1.1-VBVR-图片数字人-自动补帧
LTX-2.3-22B-DISTILLED-1.1-VBVR-图片数字人-自动补帧
16
@刘悦的技术博客
刘悦的技术博客认证作者
110
148H
更新时间2026-05-08
支持自启动
LTX-2.3-22B-DISTILLED-1.1-VBVR-图片数字人-自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词
LTX-2.3-22B-DISTILLED-1.1-VBVR-图片数字人-自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词
0/小时
LTXComfyUI视频生成
LTX-2.3-DISTILLED-1.1-多人对话-男女对唱-图片数字人
LTX-2.3-DISTILLED-1.1-多人对话-男女对唱-图片数字人
12
@刘悦的技术博客
刘悦的技术博客认证作者
56
110H
更新时间2026-05-08
支持自启动
LTX-2.3-DISTILLED-1.1-多人对话-男女对唱-图片数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-DISTILLED-1.1-多人对话-男女对唱-图片数字人,8G显存可用,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
图片生成ComfyUI
RedMix-Ernie-Image,4k超分,文生图,图生图,自动提示词,批量任务
RedMix-Ernie-Image,4k超分,文生图,图生图,自动提示词,批量任务
3
@刘悦的技术博客
刘悦的技术博客认证作者
60
29H
更新时间2026-05-02
支持自启动
RedMix-Ernie-Image,4k超分,文生图,图生图,自动提示词,批量任务
RedMix-Ernie-Image,4k超分,文生图,图生图,自动提示词,批量任务
0/小时
LTX视频生成视频编辑
LTX-2.3-DISTILLED-1.1-视频编辑-视频内容修改
LTX-2.3-DISTILLED-1.1-视频编辑-视频内容修改
9
@刘悦的技术博客
刘悦的技术博客认证作者
64
102H
更新时间2026-04-30
支持自启动
LTX-2.3-DISTILLED-1.1-视频编辑-视频内容修改
LTX-2.3-DISTILLED-1.1-视频编辑-视频内容修改
0/小时
语音合成
超强AI语音克隆,VOXCPM-V2合集,语音克隆 | 音色保存 | 多音字 | 批量生成 | 超长文本生成
超强AI语音克隆,VOXCPM-V2合集,语音克隆 | 音色保存 | 多音字 | 批量生成 | 超长文本生成
45
@与AI同行
与AI同行认证作者
382
555H
更新时间2026-04-30
支持自启动
超强AI语音克隆,VOXCPM-V2合集,语音克隆 | 音色保存 | 多音字 | 批量生成 | 超长文本生成
超强AI语音克隆,VOXCPM-V2合集,语音克隆 | 音色保存 | 多音字 | 批量生成 | 超长文本生成
0/小时
ComfyUIFlux图片生成
Flux2 Klein 微操级控图 一致性镜像
Flux2 Klein 微操级控图 一致性镜像
18
@AI-KSK
AI-KSK认证作者
159
829H
更新时间2026-04-30
支持自启动
基于 ComfyUI、Flux2 Klein 9B,集成提示词增强、参考图控制、身份保持、颜色锚定和实验采样,适合保脸换姿势、多图合成、图生图精修与高一致性人像编辑。
基于 ComfyUI、Flux2 Klein 9B,集成提示词增强、参考图控制、身份保持、颜色锚定和实验采样,适合保脸换姿势、多图合成、图生图精修与高一致性人像编辑。
0/小时
AI音乐
最强免费生成音乐,ACE-Step-V1.5-XL,免费版Suno,商业级别音乐效果!
最强免费生成音乐,ACE-Step-V1.5-XL,免费版Suno,商业级别音乐效果!
10
@与AI同行
与AI同行认证作者
53
89H
更新时间2026-04-30
支持自启动
最强免费生成音乐,ACE-Step-V1.5-XL,免费版Suno,商业级别音乐效果
最强免费生成音乐,ACE-Step-V1.5-XL,免费版Suno,商业级别音乐效果
0/小时
具身智能
openVLA
openVLA
1
@
1
0H
更新时间2026-04-30
优云首个openvla推理镜像,实现输入图片,得到动作输出
优云首个openvla推理镜像,实现输入图片,得到动作输出
0.1/小时
ComfyUILTX数字人
LTX2.3 大丝袜视频工作流 I2V/T2V/V2V/首尾帧/音频一体化镜像
LTX2.3 大丝袜视频工作流 I2V/T2V/V2V/首尾帧/音频一体化镜像
12
@AI-KSK
AI-KSK认证作者
131
87H
更新时间2026-04-30
支持自启动
LTX2.3 DaSiWa 视频生成整合镜像,基于 ComfyUI 封装,内置 OmniForge 工作流,支持图生视频、文生视频、首尾帧过渡、视频转视频与音频生成
LTX2.3 DaSiWa 视频生成整合镜像,基于 ComfyUI 封装,内置 OmniForge 工作流,支持图生视频、文生视频、首尾帧过渡、视频转视频与音频生成
0/小时
AI音乐Lora训练ComfyUI
ACE-Step-1.5UI音乐生成和Lora训练
ACE-Step-1.5UI音乐生成和Lora训练
25
@梦影Erislia
170
737H
更新时间2026-04-26
ACE-Step-1.5UI音乐生成和Lora训练
ACE-Step-1.5UI音乐生成和Lora训练
0/小时
AI漫剧
融光短视频创作平台webUI开源全流程AI视频创作平台自动化工作流
融光短视频创作平台webUI开源全流程AI视频创作平台自动化工作流
3
@鸡你太美
鸡你太美认证作者
24
40H
更新时间2026-04-27
支持自启动
可以无卡模式运行改项目
可以无卡模式运行改项目
0/小时
图片生成图片编辑
GPT-Image-2,4k超分,文生图,图生图,自动提示词,批量任务,基于国内DMXAPI接口平台
GPT-Image-2,4k超分,文生图,图生图,自动提示词,批量任务,基于国内DMXAPI接口平台
8
@刘悦的技术博客
刘悦的技术博客认证作者
111
97H
更新时间2026-04-26
支持自启动
GPT-Image-2,4k超分,文生图,图生图,自动提示词,批量任务,基于国内DMXAPI接口平台
GPT-Image-2,4k超分,文生图,图生图,自动提示词,批量任务,基于国内DMXAPI接口平台
0/小时
语音合成语音识别
OmniVoice,批量任务,智能字幕SRT配音,多人对话,接口api使用,速度1比0.3,支持超长文本,声音克隆
OmniVoice,批量任务,智能字幕SRT配音,多人对话,接口api使用,速度1比0.3,支持超长文本,声音克隆
9
@刘悦的技术博客
刘悦的技术博客认证作者
71
1300H
更新时间2026-04-25
支持自启动
OmniVoice,批量任务,智能字幕SRT配音,多人对话,接口api使用,速度1比0.3,支持超长文本,声音克隆
OmniVoice,批量任务,智能字幕SRT配音,多人对话,接口api使用,速度1比0.3,支持超长文本,声音克隆
0/小时
语音合成
OmniVoice维吾尔语TTS在线webui文本转语音声音专版
OmniVoice维吾尔语TTS在线webui文本转语音声音专版
3
@鸡你太美
鸡你太美认证作者
37
56H
更新时间2026-04-27
支持自启动
维吾尔语TTS在线webui文本转语音声音专版
维吾尔语TTS在线webui文本转语音声音专版
0/小时
图片生成
AI图片新王登基,GPT-Image-2合集,超强图片细节,低至0.04元/张!图片生成 | 多图编辑 | 批量生成 | 最火爆的60+种提示词玩法
AI图片新王登基,GPT-Image-2合集,超强图片细节,低至0.04元/张!图片生成 | 多图编辑 | 批量生成 | 最火爆的60+种提示词玩法
21
@与AI同行
与AI同行认证作者
225
1161H
更新时间2026-04-24
支持自启动
AI图片新王登基,GPT-Image-2合集,超强图片细节,低至0.04元/张!图片生成 | 多图编辑 | 批量生成 | 最火爆的60+种提示词玩法
AI图片新王登基,GPT-Image-2合集,超强图片细节,低至0.04元/张!图片生成 | 多图编辑 | 批量生成 | 最火爆的60+种提示词玩法
0/小时
视频编辑
facefusion3.5.1离线全部模型最新TensorRT加速官方原版图片换脸视频换脸高清图片 构建By科哥
facefusion3.5.1离线全部模型最新TensorRT加速官方原版图片换脸视频换脸高清图片 构建By科哥
40
@鸡你太美
鸡你太美认证作者
522
2709H
更新时间2026-04-27
支持自启动
facefusion3.6.1全模型离线
facefusion3.6.1全模型离线
0/小时
语音合成IndexTTSSVC
动漫短剧多人对话配音ComfyUi_voxcpm2
动漫短剧多人对话配音ComfyUi_voxcpm2
2
@星尘玩AI
17
27H
更新时间2026-05-20
支持自启动
支持多种语言的,单多人对话声音克隆配音
支持多种语言的,单多人对话声音克隆配音
0/小时
ComfyUI图片生成
Ernie-Image-AIO-Rapid,4k超分,文生图,图生图,自动提示词,批量任务,支持50系
Ernie-Image-AIO-Rapid,4k超分,文生图,图生图,自动提示词,批量任务,支持50系
8
@刘悦的技术博客
刘悦的技术博客认证作者
48
17H
更新时间2026-04-23
支持自启动
Ernie-Image-AIO-Rapid,4k超分,文生图,图生图,自动提示词,批量任务,支持50系
Ernie-Image-AIO-Rapid,4k超分,文生图,图生图,自动提示词,批量任务,支持50系
0/小时
AI音乐ComfyUILTX
202604ComfyUI全能整合包,LTX2.3最新cu130环境更快更稳定
202604ComfyUI全能整合包,LTX2.3最新cu130环境更快更稳定
19
@老徐Ai研习社
老徐Ai研习社认证作者
209
664H
更新时间2026-04-22
支持自启动
cu130环境更快更稳定
cu130环境更快更稳定
0/小时
IndexTTS语音合成SVC
AI动漫配音—VoxCPM2一键语音克隆、配音、训练、支持LoRA
AI动漫配音—VoxCPM2一键语音克隆、配音、训练、支持LoRA
27
@星尘玩AI
110
269H
更新时间2026-05-20
支持自启动
VoxCPM2支持AI动漫配音等多种应用场景,一键语音克隆、配音、训练、支持LoRA
VoxCPM2支持AI动漫配音等多种应用场景,一键语音克隆、配音、训练、支持LoRA
0/小时
文本模型
谷歌最新本地模型gemma4最强智能助理hermes agent一个本地免token的智能助理模型全部离线
谷歌最新本地模型gemma4最强智能助理hermes agent一个本地免token的智能助理模型全部离线
5
@鸡你太美
鸡你太美认证作者
82
109H
更新时间2026-04-27
支持自启动
谷歌最新本地模型gemma4最强智能助理hermes agent一个本地免token的智能助理模型全部离线
谷歌最新本地模型gemma4最强智能助理hermes agent一个本地免token的智能助理模型全部离线
0/小时
推理框架
ollama
ollama
0
@苍耳阿猫
苍耳阿猫认证作者
25
115H
更新时间2026-04-21
ollama-0.21.0
ollama-0.21.0
0/小时
ComfyUIWan视频生成
Wan2.2_LightX2V-260412-文生视频-首尾帧-单图无限时长,自动补帧,自定义分辨率,自适应端口,自动提示词,自动任务控制
Wan2.2_LightX2V-260412-文生视频-首尾帧-单图无限时长,自动补帧,自定义分辨率,自适应端口,自动提示词,自动任务控制
27
@刘悦的技术博客
刘悦的技术博客认证作者
245
446H
更新时间2026-04-20
支持自启动
Wan2.2_LightX2V-260412-文生视频-首尾帧-单图无限时长,自动补帧,自定义分辨率,自适应端口,自动提示词,自动任务控制
Wan2.2_LightX2V-260412-文生视频-首尾帧-单图无限时长,自动补帧,自定义分辨率,自适应端口,自动提示词,自动任务控制
0/小时
ComfyUILTX视频生成
LTX-2.3-DISTILLED-1.1-IC-Lora-动作迁移,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-DISTILLED-1.1-IC-Lora-动作迁移,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
13
@刘悦的技术博客
刘悦的技术博客认证作者
241
253H
更新时间2026-04-19
支持自启动
LTX-2.3-DISTILLED-1.1-IC-Lora-动作迁移,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-DISTILLED-1.1-IC-Lora-动作迁移,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
图片生成视频生成其他
猫影短剧AI驱动的小说转短剧全流程生产平台小说文本自动转换为短剧视频 构建by科哥
猫影短剧AI驱动的小说转短剧全流程生产平台小说文本自动转换为短剧视频 构建by科哥
14
@鸡你太美
鸡你太美认证作者
68
158H
更新时间2026-04-27
支持自启动
可以无卡模式运行改项目0.15元每小时按秒计费
可以无卡模式运行改项目0.15元每小时按秒计费
0/小时
图生文图片生成视频生成
火宝AI短视频创作系统可以无卡模型运行该项目使用前阅读使用说明
火宝AI短视频创作系统可以无卡模型运行该项目使用前阅读使用说明
0
@鸡你太美
鸡你太美认证作者
18
61H
更新时间2026-04-27
支持自启动
可以无卡模式运行改项目0.15元每小时按秒计费
可以无卡模式运行改项目0.15元每小时按秒计费
0/小时
图片生成视频生成其他
moyin AI影视生产级工具支持 Seedance 2.0剧本到成片全流程批量化 构建by科哥
moyin AI影视生产级工具支持 Seedance 2.0剧本到成片全流程批量化 构建by科哥
15
@鸡你太美
鸡你太美认证作者
66
60H
更新时间2026-04-27
支持自启动
可以无卡模式运行改项目0.15元每小时按秒计费
可以无卡模式运行改项目0.15元每小时按秒计费
0/小时
图片生成视频生成
Toonflow一款AI短剧创作工具将小说自动转化为剧本生成 AI 图片和视频的平台 构建by科哥
Toonflow一款AI短剧创作工具将小说自动转化为剧本生成 AI 图片和视频的平台 构建by科哥
10
@鸡你太美
鸡你太美认证作者
60
50H
更新时间2026-04-27
支持自启动
可以无卡模式运行改项目0.15元每小时按秒计费
可以无卡模式运行改项目0.15元每小时按秒计费
0/小时
语音合成Lora训练
VoxCPM2 一键切片打标训练集准备&训练生成一体化镜像
VoxCPM2 一键切片打标训练集准备&训练生成一体化镜像
7
@AI-KSK
AI-KSK认证作者
31
28H
更新时间2026-04-19
支持自启动
集成 VoxCPM2 一键切片、自动打标、训练集整理、LoRA 训练与生成推理,开箱即用的全流程声音克隆训练镜像。
集成 VoxCPM2 一键切片、自动打标、训练集整理、LoRA 训练与生成推理,开箱即用的全流程声音克隆训练镜像。
0/小时
数字人ComfyUIInfiniteTalk
InfiniteTalk数字人量化版
InfiniteTalk数字人量化版
11
@阿凯CDZK6688
154
859H
更新时间2026-05-10
支持自启动
InfiniteTalk数字人量化版4090效果最好,3090也可用
InfiniteTalk数字人量化版4090效果最好,3090也可用
0.1/小时
ComfyUI图片生成
ERNIE-Image:开源图像生成新王炸
ERNIE-Image:开源图像生成新王炸
7
@AI-KSK
AI-KSK认证作者
45
136H
更新时间2026-04-17
支持自启动
ERNIE-Image ComfyUI镜像,集成百度开源文生图模型,擅长文字排版、复杂指令与结构化出图,适合海报、信息图等场景
ERNIE-Image ComfyUI镜像,集成百度开源文生图模型,擅长文字排版、复杂指令与结构化出图,适合海报、信息图等场景
0/小时
语音合成
VoxCPM2雨落版整合包
VoxCPM2雨落版整合包
21
@雨落实战
雨落实战认证作者
181
1735H
更新时间2026-04-17
支持自启动
VoxCPM2雨落版整合包,支持多种业务场景
VoxCPM2雨落版整合包,支持多种业务场景
0/小时
ComfyUI图片生成
Ernie-Image-Turbo-uncensored,文生图,图生图,自动提示词,批量任务,支持50系
Ernie-Image-Turbo-uncensored,文生图,图生图,自动提示词,批量任务,支持50系
5
@刘悦的技术博客
刘悦的技术博客认证作者
75
61H
更新时间2026-04-16
支持自启动
Ernie-Image-Turbo-uncensored,文生图,图生图,自动提示词,批量任务,支持50系
Ernie-Image-Turbo-uncensored,文生图,图生图,自动提示词,批量任务,支持50系
0/小时
数字人视频生成
Musetalk训练专用
Musetalk训练专用
0
@有黑眼圈的小竹熊
4
1H
更新时间2026-04-17
支持自启动
Musetalk训练专用
Musetalk训练专用
0.3/小时
语音合成
最强AI语音克隆,LongcatAudio合集,语音克隆 | 音色保存 | 多人对话 | 字幕生成语音| 多音字 | 批量生成
最强AI语音克隆,LongcatAudio合集,语音克隆 | 音色保存 | 多人对话 | 字幕生成语音| 多音字 | 批量生成
19
@与AI同行
与AI同行认证作者
105
100H
更新时间2026-04-15
支持自启动
最强AI语音克隆,LongcatAudio合集,语音克隆 | 音色保存 | 多人对话 | 字幕生成语音| 多音字 | 批量生成,6G显存可用!
最强AI语音克隆,LongcatAudio合集,语音克隆 | 音色保存 | 多人对话 | 字幕生成语音| 多音字 | 批量生成,6G显存可用!
0/小时
Lora训练图片生成其他
百度ERNIE-Image的Lora训练AI-TOOLKIT
百度ERNIE-Image的Lora训练AI-TOOLKIT
0
@梦影Erislia
26
211H
更新时间2026-04-15
百度ERNIE-Image的Lora训练AI-TOOLKIT
百度ERNIE-Image的Lora训练AI-TOOLKIT
0/小时
视频生成
VAD-fast3.0 图生视频模型,可批量生成,3分钟出15秒视频
VAD-fast3.0 图生视频模型,可批量生成,3分钟出15秒视频
9
@Ai老邱
43
27H
更新时间2026-04-15
支持自启动
图生视频模型,可真人批量生成,3分钟出15秒视频
图生视频模型,可真人批量生成,3分钟出15秒视频
0/小时
文本模型
hermes-webui中文版支持自定义任意大模型支持微信飞书等接入
hermes-webui中文版支持自定义任意大模型支持微信飞书等接入
3
@鸡你太美
鸡你太美认证作者
14
42H
更新时间2026-04-27
支持自启动
hermes-webui中文版支持自定义任意大模型支持微信飞书等接入
hermes-webui中文版支持自定义任意大模型支持微信飞书等接入
0/小时
AI应用语音合成
ComfyUI_voxcpm全能生成_那颗星星(支持多人配音,支持lora训练,老版本支持)
ComfyUI_voxcpm全能生成_那颗星星(支持多人配音,支持lora训练,老版本支持)
19
@那颗星星
134
425H
更新时间2026-04-15
支持自启动
最强大的VoxCPM节点,支持多人配音、支持训练lora(包含数据集准备节点,傻瓜式操作)、兼容老模型
最强大的VoxCPM节点,支持多人配音、支持训练lora(包含数据集准备节点,傻瓜式操作)、兼容老模型
0/小时
ComfyUILora训练语音合成
VoxCPM2语音克隆工作流LORA训练comfy支持
VoxCPM2语音克隆工作流LORA训练comfy支持
8
@梦影Erislia
67
89H
更新时间2026-04-14
VoxCPM2 TTS语音克隆工作流LORA训练comfy支持
VoxCPM2 TTS语音克隆工作流LORA训练comfy支持
0/小时
语音合成
最强AI音色克隆,OmniVoice合集,音色克隆 | 语气控制 | 音色保存 | 多音字 | 批量生成
最强AI音色克隆,OmniVoice合集,音色克隆 | 语气控制 | 音色保存 | 多音字 | 批量生成
22
@与AI同行
与AI同行认证作者
1001
973H
更新时间2026-04-13
支持自启动
最强AI音色克隆,OmniVoice合集,音色克隆 | 语气控制 | 音色保存 | 多音字 | 批量生成
最强AI音色克隆,OmniVoice合集,音色克隆 | 语气控制 | 音色保存 | 多音字 | 批量生成
0/小时
FluxComfyUI图片生成
Flux.2-Klein-9B-GGUF
Flux.2-Klein-9B-GGUF
90
@刘悦的技术博客
刘悦的技术博客认证作者
1112
2384H
更新时间2026-04-13
支持自启动
Flux.2-Klein-9B-GGUF,局部重绘,文生图,图像编辑,多图编辑,自动提示词,批量任务,支持最新50系和计算卡
Flux.2-Klein-9B-GGUF,局部重绘,文生图,图像编辑,多图编辑,自动提示词,批量任务,支持最新50系和计算卡
0/小时
语音合成AI音乐
Ace-Step-1.5-XL-Turbo,歌曲生成,音乐生成,文字转歌曲,歌曲创作,支持50系
Ace-Step-1.5-XL-Turbo,歌曲生成,音乐生成,文字转歌曲,歌曲创作,支持50系
7
@刘悦的技术博客
刘悦的技术博客认证作者
43
298H
更新时间2026-04-12
支持自启动
Ace-Step-1.5-XL-Turbo,歌曲生成,音乐生成,文字转歌曲,歌曲创作,支持50系
Ace-Step-1.5-XL-Turbo,歌曲生成,音乐生成,文字转歌曲,歌曲创作,支持50系
0/小时
IndexTTSQwen3-TTSCosyVoice
咸鱼鱼VoxCPM
咸鱼鱼VoxCPM
8
@后期咸鱼鱼-小帆
107
123H
更新时间2026-04-13
支持自启动
VoxCPM2
VoxCPM2
0/小时
语音合成
VoxCPM2
VoxCPM2
5
@鹄仙
鹄仙认证作者
67
280H
更新时间2026-04-11
多语言的声音克隆和设计项目,支持lora训练
多语言的声音克隆和设计项目,支持lora训练
0/小时
语音合成IndexTTS语音识别
LongCat-AudioDiT 剧本创作台
LongCat-AudioDiT 剧本创作台
1
@K哥讲AI
K哥讲AI认证作者
12
155H
更新时间2026-04-13
支持自启动
LongCat-AudioDiT WebUI 是基于该模型的可视化工具,支持音色库管理、剧本队列编排、长文本切分及音频生成,模块化设计配中文注释,本地部署开源免费,小白可轻松实现高质量语音克隆。
LongCat-AudioDiT WebUI 是基于该模型的可视化工具,支持音色库管理、剧本队列编排、长文本切分及音频生成,模块化设计配中文注释,本地部署开源免费,小白可轻松实现高质量语音克隆。
0/小时
ComfyUILTXLora训练
ltx2.3-aitookit
ltx2.3-aitookit
5
@有趣的80后程序员
有趣的80后程序员认证作者
75
121H
更新时间2026-04-13
支持自启动
ltx2.3 aitookit Lora训练镜像
ltx2.3 aitookit Lora训练镜像
0/小时
IndexTTS语音合成AI应用
indextts-v1.52支持api调用deepspeed推理加速,并发请求,为AI直播优化的版本
indextts-v1.52支持api调用deepspeed推理加速,并发请求,为AI直播优化的版本
7
@屾哥日记
73
33868H
更新时间2026-04-10
支持自启动
indextts-v1.52支持api调用deepspeed推理加速,并发请求,为AI直播优化的版本
indextts-v1.52支持api调用deepspeed推理加速,并发请求,为AI直播优化的版本
0/小时
物理模拟分子动力
Gromacs系列
Gromacs系列
28
@苍耳阿猫
苍耳阿猫认证作者
608
20345H
更新时间2026-04-09
该镜像集成开源高性能分子动力学模拟软件,通过强化多精度算法与GPU并行加速(支持NVIDIA/AMD显卡)实现纳秒级生物大分子运动模拟,优化AI辅助建模与超大体系计算效率,提供跨平台开箱即用解决方案
该镜像集成开源高性能分子动力学模拟软件,通过强化多精度算法与GPU并行加速(支持NVIDIA/AMD显卡)实现纳秒级生物大分子运动模拟,优化AI辅助建模与超大体系计算效率,提供跨平台开箱即用解决方案
0/小时
GLMOCR识别
GLM-OCR
GLM-OCR
1
@苍耳阿猫
苍耳阿猫认证作者
3
1H
更新时间2026-04-09
GLM-OCR
GLM-OCR
0/小时
语音合成语音识别
VOXCPM2语音合成,TTS,多音字控制,接口API调用,语速调节,支持50系,支持老显卡,音色保存,方言控制,开源阅读,支持超长文本
VOXCPM2语音合成,TTS,多音字控制,接口API调用,语速调节,支持50系,支持老显卡,音色保存,方言控制,开源阅读,支持超长文本
10
@刘悦的技术博客
刘悦的技术博客认证作者
132
220H
更新时间2026-04-08
支持自启动
VOXCPM2语音合成,TTS,多音字控制,接口API调用,语速调节,支持50系,支持老显卡,音色保存,方言控制,开源阅读,支持超长文本
VOXCPM2语音合成,TTS,多音字控制,接口API调用,语速调节,支持50系,支持老显卡,音色保存,方言控制,开源阅读,支持超长文本
0/小时
AI音乐
AI音乐制作ACE-Step-1.5XL官方包
AI音乐制作ACE-Step-1.5XL官方包
9
@鹄仙
鹄仙认证作者
60
699H
更新时间2026-04-08
专业级别的AI音乐制作项目升级XL
专业级别的AI音乐制作项目升级XL
0/小时
文本模型推理框架
Gemma-4 + GPT-OSS-120B 双破限大模型 WebUI 开箱即用镜像
Gemma-4 + GPT-OSS-120B 双破限大模型 WebUI 开箱即用镜像
24
@AI-KSK
AI-KSK认证作者
122
136H
更新时间2026-04-09
支持自启动
基于 Ollama + Open WebUI 搭建的双破限大模型共享镜像,集成 Gemma-4 与 GPT-OSS-120B 两类核心模型,支持浏览器直接访问与可视化聊天。
基于 Ollama + Open WebUI 搭建的双破限大模型共享镜像,集成 Gemma-4 与 GPT-OSS-120B 两类核心模型,支持浏览器直接访问与可视化聊天。
0/小时
数字人LTXComfyUI
LTX-2.3-VBVR-图片数字人,真正无限时长,分片推理,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-VBVR-图片数字人,真正无限时长,分片推理,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
13
@刘悦的技术博客
刘悦的技术博客认证作者
104
177H
更新时间2026-04-07
支持自启动
LTX-2.3-VBVR-图片数字人,真正无限时长,分片推理,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-VBVR-图片数字人,真正无限时长,分片推理,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
视频生成LTX
LTX-2.3-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
13
@刘悦的技术博客
刘悦的技术博客认证作者
109
109H
更新时间2026-04-07
支持自启动
LTX-2.3-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-VBVR-文生视频-首尾帧,单图无限时长,自动补帧,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
语音合成语音识别
OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源
OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源
21
@刘悦的技术博客
刘悦的技术博客认证作者
225
735H
更新时间2026-04-05
支持自启动
OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源
OmniVoice,接口api使用,支持600种语言,4G显存可用,速度1比0.3,文本指令,支持呻吟笑声,文字转语音,支持超长文本,声音克隆,小米k2-fsa团队开源
0/小时
语音合成语音识别
LongCat-AudioDiT-1B-3.5B,TTS,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,文字转语音,TTS
LongCat-AudioDiT-1B-3.5B,TTS,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,文字转语音,TTS
4
@刘悦的技术博客
刘悦的技术博客认证作者
44
40H
更新时间2026-04-05
支持自启动
LongCat-AudioDiT-1B-3.5B,6G显存可用,TTS,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,文字转语音,TTS
LongCat-AudioDiT-1B-3.5B,6G显存可用,TTS,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,文字转语音,TTS
0/小时
语音合成
ComfyUI-OmniVoice-TTS小米团队开源单人多人声音克隆语音克隆捏声音
ComfyUI-OmniVoice-TTS小米团队开源单人多人声音克隆语音克隆捏声音
4
@鸡你太美
鸡你太美认证作者
44
35H
更新时间2026-04-27
支持自启动
ComfyUI-OmniVoice-TTS小米团队开源单人多人声音克隆语音克隆捏声音
ComfyUI-OmniVoice-TTS小米团队开源单人多人声音克隆语音克隆捏声音
0/小时
其他
trading-agents针对国内股票的股票交易Agent
trading-agents针对国内股票的股票交易Agent
1
@鸡你太美
鸡你太美认证作者
7
45H
更新时间2026-04-27
支持自启动
trading-agents针对国内股票的股票交易Agent
trading-agents针对国内股票的股票交易Agent
0/小时
视频生成
最强AI视频抠像,MatAnyone2,超强抠像效果,支持超长视频!
最强AI视频抠像,MatAnyone2,超强抠像效果,支持超长视频!
10
@与AI同行
与AI同行认证作者
106
188H
更新时间2026-04-06
支持自启动
最强AI视频抠像,MatAnyone2,超强抠像效果,支持超长视频!
最强AI视频抠像,MatAnyone2,超强抠像效果,支持超长视频!
0/小时
Lora训练
ai-toolkit全能Lora模型训练王
ai-toolkit全能Lora模型训练王
18
@老徐Ai研习社
老徐Ai研习社认证作者
215
3567H
更新时间2026-04-09
支持自启动
主流模型都有
主流模型都有
0/小时
ComfyUI视频生成视频编辑
wan2.2动作迁移
wan2.2动作迁移
27
@
213
54H
更新时间2026-04-02
wan2.2动作迁移
wan2.2动作迁移
0/小时
ComfyUIQwen-Image图片编辑
Qwen-Edit-2511-Rapid-V23,图像编辑,表情控制,多图编辑,自动提示词,批量任务,支持50系
Qwen-Edit-2511-Rapid-V23,图像编辑,表情控制,多图编辑,自动提示词,批量任务,支持50系
36
@刘悦的技术博客
刘悦的技术博客认证作者
462
1077H
更新时间2026-04-01
支持自启动
Qwen-Edit-2511-Rapid-V23,图像编辑,表情控制,多图编辑,自动提示词,批量任务,支持50系
Qwen-Edit-2511-Rapid-V23,图像编辑,表情控制,多图编辑,自动提示词,批量任务,支持50系
0/小时
AI应用图片编辑图像分割
Live2d神器一键拆分See-through
Live2d神器一键拆分See-through
55
@梦影Erislia
867
1762H
更新时间2026-03-31
Live2d神器一键拆分See-through
Live2d神器一键拆分See-through
0/小时
语音合成
MOSS-TTS 语音模型
MOSS-TTS 语音模型
5
@刘悦的技术博客
刘悦的技术博客认证作者
54
64H
更新时间2026-03-31
支持自启动
MOSS-TTS,接口API,语音合成,声音克隆,TTS,支持超长文本,支持50系
MOSS-TTS,接口API,语音合成,声音克隆,TTS,支持超长文本,支持50系
0/小时
ComfyUILTX视频生成
LTX-2.3-Transition-文生视频
LTX-2.3-Transition-文生视频
7
@刘悦的技术博客
刘悦的技术博客认证作者
111
118H
更新时间2026-03-30
支持自启动
LTX-2.3-Transition-文生视频-首尾帧,无限时长,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
LTX-2.3-Transition-文生视频-首尾帧,无限时长,支持50系,自定义分辨率,自适应端口,自动提示词,批量任务队列
0/小时
视频生成
X-Dub-WebUI
X-Dub-WebUI
1
@鸡你太美
鸡你太美认证作者
20
20H
更新时间2026-04-27
支持自启动
X-Dub-WebUI可灵团队推出的视频驱动唇形生成与任意尺寸视频数字人视频生成 二次开发webui构建By科哥
X-Dub-WebUI可灵团队推出的视频驱动唇形生成与任意尺寸视频数字人视频生成 二次开发webui构建By科哥
0/小时
LTX视频生成数字人
LTX-2.3-Transition--图片数字人
LTX-2.3-Transition--图片数字人
11
@刘悦的技术博客
刘悦的技术博客认证作者
112
148H
更新时间2026-03-30
支持自启动
LTX-2.3-Transition--图片数字人,更好的稳定性,无限时长,支持50系,自定义分辨率
LTX-2.3-Transition--图片数字人,更好的稳定性,无限时长,支持50系,自定义分辨率
0/小时
图片生成图片编辑
最强AI图片编辑,FireRed-Edit整合包合集,商用顶级图片效果!
最强AI图片编辑,FireRed-Edit整合包合集,商用顶级图片效果!
27
@与AI同行
与AI同行认证作者
414
2499H
更新时间2026-03-31
支持自启动
最强AI图片编辑,FireRed-Edit整合包合集,商用顶级图片效果!支持多图编辑、局部涂抹编辑、高清放大,解压即用,一键启动!
最强AI图片编辑,FireRed-Edit整合包合集,商用顶级图片效果!支持多图编辑、局部涂抹编辑、高清放大,解压即用,一键启动!
0/小时
ComfyUI视频编辑视频生成
陈晨的comfyui云端镜像系列
陈晨的comfyui云端镜像系列
13
@陈晨
119
264H
更新时间2026-03-30
支持自启动
内置多个工作流 开箱即用
内置多个工作流 开箱即用
0/小时
数字人ComfyUI视频生成
图片·声音·视频·2603comfyui全能整合包
图片·声音·视频·2603comfyui全能整合包
34
@老徐Ai研习社
老徐Ai研习社认证作者
312
2872H
更新时间2026-03-26
支持自启动
图片·声音·视频·2603comfyui全能整合包
图片·声音·视频·2603comfyui全能整合包
0/小时
ComfyUILTX视频生成
LTX-2.3 LoRA训练 +AIToolkit 4090/48G/5090 一键开训
LTX-2.3 LoRA训练 +AIToolkit 4090/48G/5090 一键开训
6
@AI-KSK
AI-KSK认证作者
82
640H
更新时间2026-03-28
集成AIToolkit与LTX-2 LoRA训练全套环境,适配4090 48G/5090预设参数,支持一键启动、缓存优化、依赖预装,开箱即可进行音视频LoRA训练
集成AIToolkit与LTX-2 LoRA训练全套环境,适配4090 48G/5090预设参数,支持一键启动、缓存优化、依赖预装,开箱即可进行音视频LoRA训练
0/小时
数字人ComfyUIFlux
LTX2.3 创作增强旗舰版
LTX2.3 创作增强旗舰版
20
@AI-KSK
AI-KSK认证作者
141
227H
更新时间2026-03-26
基于LTX2.3深度整合的全功能创作镜像,集成ID-LoRA、换头、局部重绘、多图首尾帧等特色能力,环境完整、依赖丰富,适合视频生成、角色一致性控制与多场景创作。
基于LTX2.3深度整合的全功能创作镜像,集成ID-LoRA、换头、局部重绘、多图首尾帧等特色能力,环境完整、依赖丰富,适合视频生成、角色一致性控制与多场景创作。
0/小时
LTXLora训练视频生成
LTX2.3Lora训练用AI-toolkit,简单配置一键训练
LTX2.3Lora训练用AI-toolkit,简单配置一键训练
10
@梦影Erislia
161
3037H
更新时间2026-03-25
LTX2.3Lora训练用AI-toolkit,简单配置一键训练
LTX2.3Lora训练用AI-toolkit,简单配置一键训练
0/小时
数据分析其他
MiroFish一个ai预测系统数据模型预测ai系统 构建by科哥
MiroFish一个ai预测系统数据模型预测ai系统 构建by科哥
4
@鸡你太美
鸡你太美认证作者
18
39H
更新时间2026-04-27
支持自启动
MiroFish一个ai预测系统数据模型预测ai系统 构建by科哥
MiroFish一个ai预测系统数据模型预测ai系统 构建by科哥
0/小时
AI应用视频编辑图片编辑
MatAnyone2
MatAnyone2
3
@刘悦的技术博客
刘悦的技术博客认证作者
95
120H
更新时间2026-03-23
支持自启动
MatAnyone2,视频图片一键去背,换背景,智能提取前景主体,支持GPU和纯CPU推理,绿幕生成器
MatAnyone2,视频图片一键去背,换背景,智能提取前景主体,支持GPU和纯CPU推理,绿幕生成器
0/小时
AI音乐
SoulX-Singer-SVC
SoulX-Singer-SVC
18
@鹄仙
鹄仙认证作者
179
304H
更新时间2026-03-20
一键翻唱神器
一键翻唱神器
0/小时
Lora训练LTX其他
LTX2.3Lora训练支持Musubi-tuner
LTX2.3Lora训练支持Musubi-tuner
6
@梦影Erislia
94
538H
更新时间2026-03-18
LTX2.3Lora训练支持Musubi-tuner
LTX2.3Lora训练支持Musubi-tuner
0/小时
Qwen3-TTS语音合成语音识别
Faster-Qwen3-TTS
Faster-Qwen3-TTS
89
@刘悦的技术博客
刘悦的技术博客认证作者
351
823H
更新时间2026-03-18
支持自启动
Faster-Qwen3-TTS,流式接口API,实时推理,速度1比0.5,多人对话,智能多音字,4G显存可用,批量任务,支持超长文本,支持50系显卡,支持老显卡
Faster-Qwen3-TTS,流式接口API,实时推理,速度1比0.5,多人对话,智能多音字,4G显存可用,批量任务,支持超长文本,支持50系显卡,支持老显卡
0/小时
语音合成
Fish-Speech-S2-Pro-4B
Fish-Speech-S2-Pro-4B
9
@刘悦的技术博客
刘悦的技术博客认证作者
98
317H
更新时间2026-03-18
支持自启动
Fish-Speech-S2-Pro-4B,接口api使用,支持62种语言,文本指令,文字转语音,声音克隆,zero-shot
Fish-Speech-S2-Pro-4B,接口api使用,支持62种语言,文本指令,文字转语音,声音克隆,zero-shot
0/小时
AI音乐
SongGeneration音乐生成
SongGeneration音乐生成
7
@鹄仙
鹄仙认证作者
23
24H
更新时间2026-03-20
音乐生成工具,应用简单
音乐生成工具,应用简单
0/小时
ComfyUIZ-Image图片生成
Z-Image Turbo 无限制生成控制放大一体化镜像
Z-Image Turbo 无限制生成控制放大一体化镜像
36
@AI-KSK
AI-KSK认证作者
421
890H
更新时间2026-03-13
集成文生图、图生图、ControlNet 控制、提示词优化、放大增强等全员破限工作流。
集成文生图、图生图、ControlNet 控制、提示词优化、放大增强等全员破限工作流。
0/小时
ComfyUIWan视频超分
视频批量补帧、超分放大与细节修复,ComfyUI视频增强镜像,Seedance2.0黄金搭档
视频批量补帧、超分放大与细节修复,ComfyUI视频增强镜像,Seedance2.0黄金搭档
39
@AI-KSK
AI-KSK认证作者
221
1102H
更新时间2026-03-12
集成 FlashVSR / GIMM / LTX-2 / SeedVR2 的 ComfyUI 视频增强镜像,一键批量补帧、放大、细节修复。
集成 FlashVSR / GIMM / LTX-2 / SeedVR2 的 ComfyUI 视频增强镜像,一键批量补帧、放大、细节修复。
0/小时
LTXComfyUI数字人
LTX-2.3-GGUF-图片数字人
LTX-2.3-GGUF-图片数字人
19
@刘悦的技术博客
刘悦的技术博客认证作者
197
349H
更新时间2026-03-18
支持自启动
LTX-2.3-GGUF-图片数字人-无限时长,更好的一致性,8步采样,支持50系,自定义分辨率,自动补帧,自动提示词,批量任务队列
LTX-2.3-GGUF-图片数字人-无限时长,更好的一致性,8步采样,支持50系,自定义分辨率,自动补帧,自动提示词,批量任务队列
0/小时
ComfyUILTX视频生成
LTX-2.3-GGUF-图生视频
LTX-2.3-GGUF-图生视频
31
@刘悦的技术博客
刘悦的技术博客认证作者
360
578H
更新时间2026-03-18
支持自启动
LTX-2.3-GGUF-图生视频-无限时长,更好的一致性,8步采样,自定义分辨率,自动补帧,自动提示词,批量任务队列
LTX-2.3-GGUF-图生视频-无限时长,更好的一致性,8步采样,自定义分辨率,自动补帧,自动提示词,批量任务队列
0/小时
Lora训练推理框架文本模型
大模型微调部署测评_LLaMa-Factory>vLLM>opencompass
大模型微调部署测评_LLaMa-Factory>vLLM>opencompass
3
@影赤
33
185H
更新时间2026-03-10
大模型微调部署测评全流程环境已安装
大模型微调部署测评全流程环境已安装
0/小时
ComfyUILTXWan
图片-声音-视频Comfyui全量整合包-LTX2.3-Wan2.2-Z-Image-Turbo漫剧全能助手
图片-声音-视频Comfyui全量整合包-LTX2.3-Wan2.2-Z-Image-Turbo漫剧全能助手
72
@老徐Ai研习社
老徐Ai研习社认证作者
695
8185H
更新时间2026-03-10
支持自启动
漫剧全能助手
漫剧全能助手
0/小时
ComfyUIQwen-Image图片编辑
FireRed-ImageEdit-V1.1-GGUF
FireRed-ImageEdit-V1.1-GGUF
24
@刘悦的技术博客
刘悦的技术博客认证作者
188
242H
更新时间2026-03-18
支持自启动
FireRed-ImageEdit-V1.1-GGUF,局部重绘,图像编辑,4步采样,多图编辑,支持50系,自定义分辨率
FireRed-ImageEdit-V1.1-GGUF,局部重绘,图像编辑,4步采样,多图编辑,支持50系,自定义分辨率
0/小时
LTXComfyUI视频生成
LTX-2.3 开源音视频一体生成模型|文生视频+图生视频
LTX-2.3 开源音视频一体生成模型|文生视频+图生视频
12
@AI-KSK
AI-KSK认证作者
143
376H
更新时间2026-03-10
基于 LTX-2.3 的音视频一体生成模型镜像,支持文生视频、图生视频等常见生成方式
基于 LTX-2.3 的音视频一体生成模型镜像,支持文生视频、图生视频等常见生成方式
0/小时
Lora训练
Z-Image 模型一站式训练 & 推理-None_Z-trainer
Z-Image 模型一站式训练 & 推理-None_Z-trainer
5
@zypAIGC
27
9H
更新时间2026-03-06
支持自启动
Z-Image 模型一站式训练 & 推理-None_Z-trainer
Z-Image 模型一站式训练 & 推理-None_Z-trainer
0.2/小时
ComfyUIWan视频生成
Wan2.2-SmoothMixV20-SVI2-VBVR,图生视频,无限时长,自动补帧,8步采样,无须手动复制粘贴节点,,支持批量任务,Comfyui
Wan2.2-SmoothMixV20-SVI2-VBVR,图生视频,无限时长,自动补帧,8步采样,无须手动复制粘贴节点,,支持批量任务,Comfyui
43
@刘悦的技术博客
刘悦的技术博客认证作者
476
989H
更新时间2026-03-06
支持自启动
Wan2.2-SmoothMixV20-SVI2-VBVR,图生视频,无限时长,自动补帧,8步采样,无须手动复制粘贴节点,,支持批量任务,Comfyui
Wan2.2-SmoothMixV20-SVI2-VBVR,图生视频,无限时长,自动补帧,8步采样,无须手动复制粘贴节点,,支持批量任务,Comfyui
0/小时
Lora训练
diffusion-pipe+ai-toolkit丹炉
diffusion-pipe+ai-toolkit丹炉
3
@zypAIGC
8
10H
更新时间2026-03-06
支持自启动
diffusion-pipe+ai-toolkit
diffusion-pipe+ai-toolkit
0.1/小时
ComfyUIZ-Image图片生成
Qwen3-4b-Z-Image-Engineer,文生图,图生图,洗图,6G显存可用,局部重绘,自动提示词,支持50系,批量任务队列
Qwen3-4b-Z-Image-Engineer,文生图,图生图,洗图,6G显存可用,局部重绘,自动提示词,支持50系,批量任务队列
37
@刘悦的技术博客
刘悦的技术博客认证作者
418
788H
更新时间2026-03-10
支持自启动
Qwen3-4b-Z-Image-Engineer,文生图,图生图,洗图,6G显存可用,局部重绘,自动提示词,支持50系,批量任务队列
Qwen3-4b-Z-Image-Engineer,文生图,图生图,洗图,6G显存可用,局部重绘,自动提示词,支持50系,批量任务队列
0/小时
视频生成
SoulX-FlashTalk数字人视频图片生成ai数字人说话数字人 webui二次开发
SoulX-FlashTalk数字人视频图片生成ai数字人说话数字人 webui二次开发
6
@鸡你太美
鸡你太美认证作者
13
31H
更新时间2026-05-09
支持自启动
SoulX-FlashTalk数字人视频图片生成ai数字人说话数字人 webui二次开发 构建by科哥
SoulX-FlashTalk数字人视频图片生成ai数字人说话数字人 webui二次开发 构建by科哥
0/小时
生物信息分子动力
RFantibody
RFantibody
1
@苍耳阿猫
苍耳阿猫认证作者
6
28H
更新时间2026-03-03
RFantibody
RFantibody
0/小时
AI应用
OpenClaw / ClawdBot
OpenClaw / ClawdBot
26
@优云智算
508
19354H
更新时间2026-03-16
OpenClaw 2026.3.2版本,支持飞书、Telegram接入,支持优云智算模型API
OpenClaw 2026.3.2版本,支持飞书、Telegram接入,支持优云智算模型API
0/小时
数字人WanLTX
SoulX-FlashHead-图片数字人,支持贴回全身数字人,低配版InfiniteTalk,唱歌数字人,支持长视频
SoulX-FlashHead-图片数字人,支持贴回全身数字人,低配版InfiniteTalk,唱歌数字人,支持长视频
20
@刘悦的技术博客
刘悦的技术博客认证作者
138
220H
更新时间2026-03-03
支持自启动
SoulX-FlashHead-图片数字人,支持贴回全身数字人,低配版InfiniteTalk,唱歌数字人,支持长视频
SoulX-FlashHead-图片数字人,支持贴回全身数字人,低配版InfiniteTalk,唱歌数字人,支持长视频
0/小时
Qwen
Qwen3.5_35b_a3b_Q4_K_M
Qwen3.5_35b_a3b_Q4_K_M
7
@
74
379H
更新时间2026-03-02
qwen3.5
qwen3.5
0.1/小时
ComfyUIWan视频生成
Wan2.2双增强:UnifiedReward让文生视频更符合审美预期,VBVR让图生视频更符合真实运动逻辑
Wan2.2双增强:UnifiedReward让文生视频更符合审美预期,VBVR让图生视频更符合真实运动逻辑
13
@AI-KSK
AI-KSK认证作者
193
427H
更新时间2026-03-06
这个镜像内置 Wan2.2 两套增强技术:UnifiedReward 让文生视频更好看、更符合偏好,VBVR 让图生视频动作更合理、更符合逻辑。
这个镜像内置 Wan2.2 两套增强技术:UnifiedReward 让文生视频更好看、更符合偏好,VBVR 让图生视频动作更合理、更符合逻辑。
0/小时
语音识别Qwen3-TTS语音分离
Qwen3-ASR-1.7B,语音转文字字幕,视频转字幕,支持50系显卡,批量任务,支持热词控制
Qwen3-ASR-1.7B,语音转文字字幕,视频转字幕,支持50系显卡,批量任务,支持热词控制
8
@刘悦的技术博客
刘悦的技术博客认证作者
98
888H
更新时间2026-06-05
支持自启动
Qwen3-ASR-1.7B,语音转文字字幕,视频转字幕,支持50系显卡,批量任务,支持热词控制
Qwen3-ASR-1.7B,语音转文字字幕,视频转字幕,支持50系显卡,批量任务,支持热词控制
0/小时
InfiniteTalk其他数字人
life学员
life学员
6
@life
40
206H
更新时间2026-02-28
life学员专用数字人镜像
life学员专用数字人镜像
0/小时
ComfyUIWan视频生成
Comfy漫画上色DasiWa视频支持自由拉取C站模型更新等
Comfy漫画上色DasiWa视频支持自由拉取C站模型更新等
8
@梦影Erislia
99
341H
更新时间2026-02-27
Comfy漫画上色DasiWa视频支持自由拉取C站模型更新等
Comfy漫画上色DasiWa视频支持自由拉取C站模型更新等
0/小时
视频生成
超快视频替换背景Video-BGR
超快视频替换背景Video-BGR
18
@与AI同行
与AI同行认证作者
64
48H
更新时间2026-03-31
支持自启动
超快视频替换背景Video-BGR
超快视频替换背景Video-BGR
0/小时
数字人视频超分
HeyGem数字人最新Onnx优化版,多人同时驱动,多人指定面部驱动,接口API调用,支持50系,面部超分,推理速度1比1,唱歌数字人,批量任务
HeyGem数字人最新Onnx优化版,多人同时驱动,多人指定面部驱动,接口API调用,支持50系,面部超分,推理速度1比1,唱歌数字人,批量任务
51
@刘悦的技术博客
刘悦的技术博客认证作者
864
10318H
更新时间2026-03-09
支持自启动
HeyGem数字人最新Onnx优化版,多人同时驱动,多人指定面部驱动,接口API调用,支持50系,面部超分,推理速度1比1,唱歌数字人,批量任务
HeyGem数字人最新Onnx优化版,多人同时驱动,多人指定面部驱动,接口API调用,支持50系,面部超分,推理速度1比1,唱歌数字人,批量任务
0/小时
AI应用
DocCaptioner 打标器
DocCaptioner 打标器
14
@Doc_workBox
Doc_workBox认证作者
133
230H
更新时间2026-02-26
支持自启动
Doc的打标器,支持 Qwen3vl及 API 调用
Doc的打标器,支持 Qwen3vl及 API 调用
0.1/小时
语音合成语音识别
 Ming-omni-tts-0.5B,接口API调用,支持超长文本,情感控制,中英混读,支持50系显卡
Ming-omni-tts-0.5B,接口API调用,支持超长文本,情感控制,中英混读,支持50系显卡
6
@刘悦的技术博客
刘悦的技术博客认证作者
38
326H
更新时间2026-02-25
支持自启动
Ming-omni-tts-0.5B,接口API调用,支持超长文本,情感控制,中英混读,支持50系显卡
Ming-omni-tts-0.5B,接口API调用,支持超长文本,情感控制,中英混读,支持50系显卡
0/小时
语音识别
FireRedASR2S语音识别转文字语音转文本音频转文本模型ai系统 二次构建开发 by科哥
FireRedASR2S语音识别转文字语音转文本音频转文本模型ai系统 二次构建开发 by科哥
2
@鸡你太美
鸡你太美认证作者
26
28H
更新时间2026-04-27
支持自启动
FireRedASR2S语音识别转文字语音转文本音频转文本模型ai系统 二次构建开发 by科哥
FireRedASR2S语音识别转文字语音转文本音频转文本模型ai系统 二次构建开发 by科哥
0/小时
ComfyUI视频生成Wan
终极角色动画合集镜像Wan 2.2、SCAIL、SteadyDancer、OneToAll 和VACE Phantom
终极角色动画合集镜像Wan 2.2、SCAIL、SteadyDancer、OneToAll 和VACE Phantom
16
@AI-KSK
AI-KSK认证作者
48
32H
更新时间2026-02-26
Wan 2.2、SCAIL、SteadyDancer、OneToAll 和VACE_Skyreels_V3_R2V的“五合一”整合镜像
Wan 2.2、SCAIL、SteadyDancer、OneToAll 和VACE_Skyreels_V3_R2V的“五合一”整合镜像
0/小时
目标检测
羊羊小栈-YOLO目标检测大模型分析系统
羊羊小栈-YOLO目标检测大模型分析系统
1
@
21
350H
更新时间2026-02-25
支持自启动
YOLO模型训练
YOLO模型训练
0/小时
语音合成
AudioX 统一音频生成平台通过一段提示词一段视频推理一段配音音效 webui汉化构建by科哥
AudioX 统一音频生成平台通过一段提示词一段视频推理一段配音音效 webui汉化构建by科哥
2
@鸡你太美
鸡你太美认证作者
27
56H
更新时间2026-04-27
支持自启动
AudioX 统一音频生成平台通过一段提示词一段视频推理一段配音音效 webui汉化构建by科哥
AudioX 统一音频生成平台通过一段提示词一段视频推理一段配音音效 webui汉化构建by科哥
0/小时
文本模型行业模型推理框架
HunYuan-MT-7B-abliterated,40种多国语言无限制双向翻译,长文本翻译,字幕翻译,双语字幕,腾讯开源,不文明用语翻译
HunYuan-MT-7B-abliterated,40种多国语言无限制双向翻译,长文本翻译,字幕翻译,双语字幕,腾讯开源,不文明用语翻译
5
@刘悦的技术博客
刘悦的技术博客认证作者
16
10H
更新时间2026-02-25
支持自启动
HunYuan-MT-7B-abliterated,40种多国语言无限制双向翻译,长文本翻译,字幕翻译,双语字幕,腾讯开源,不文明用语翻译
HunYuan-MT-7B-abliterated,40种多国语言无限制双向翻译,长文本翻译,字幕翻译,双语字幕,腾讯开源,不文明用语翻译
0/小时
ComfyUIQwen-Image图片编辑
FireRed-ImageEdit,图像编辑,多图编辑,支持50系,自定义分辨率,自动提示词,批量任务队列,基于Comfyui
FireRed-ImageEdit,图像编辑,多图编辑,支持50系,自定义分辨率,自动提示词,批量任务队列,基于Comfyui
29
@刘悦的技术博客
刘悦的技术博客认证作者
301
534H
更新时间2026-02-25
支持自启动
FireRed-ImageEdit,图像编辑,多图编辑,支持50系,自定义分辨率,自动提示词,批量任务队列,基于Comfyui
FireRed-ImageEdit,图像编辑,多图编辑,支持50系,自定义分辨率,自动提示词,批量任务队列,基于Comfyui
0/小时
图片生成AI应用
BitDance-14B高速自回归生图模型,自启动WebUI版测试镜像
BitDance-14B高速自回归生图模型,自启动WebUI版测试镜像
0
@AI-KSK
AI-KSK认证作者
24
32H
更新时间2026-02-25
支持自启动
BitDance-14B自启动 WebUI 测试镜像:开箱即用、中文可用、512/1024 双分辨率支持,面向高效验证与稳定出图。
BitDance-14B自启动 WebUI 测试镜像:开箱即用、中文可用、512/1024 双分辨率支持,面向高效验证与稳定出图。
0/小时
AI音乐语音识别
SoulX-Singer歌曲翻唱 带官方Midi编辑器
SoulX-Singer歌曲翻唱 带官方Midi编辑器
8
@鹄仙
鹄仙认证作者
70
47H
更新时间2026-03-20
SoulX-Singer歌曲翻唱 带官方Midi编辑器完成精细翻唱编辑
SoulX-Singer歌曲翻唱 带官方Midi编辑器完成精细翻唱编辑
0/小时
语音合成Qwen3-TTS
Qwen3-TTS-AllinOne
Qwen3-TTS-AllinOne
41
@刘悦的技术博客
刘悦的技术博客认证作者
499
1671H
更新时间2026-02-27
支持自启动
Qwen3-TTS-AllinOne,多音字控制,英文数字发音纠正,批量任务,音色保存,接口API调用,支持超长文本,语速调节,文字转语音,TTS
Qwen3-TTS-AllinOne,多音字控制,英文数字发音纠正,批量任务,音色保存,接口API调用,支持超长文本,语速调节,文字转语音,TTS
0/小时
图片生成视频生成
Penguin-Magic一个图片视频API在线生成的无限画布的批量生成工作流开源项目 构建by科哥
Penguin-Magic一个图片视频API在线生成的无限画布的批量生成工作流开源项目 构建by科哥
1
@鸡你太美
鸡你太美认证作者
6
13H
更新时间2026-04-27
支持自启动
Penguin-Magic一个图片视频API在线生成的无限画布的批量生成工作流开源项目 构建by科哥 版权属于原作者
Penguin-Magic一个图片视频API在线生成的无限画布的批量生成工作流开源项目 构建by科哥 版权属于原作者
0/小时
数字人
LiveTalking_GPT-SOVITS-V2_Ollama_洛曦AI数字人
LiveTalking_GPT-SOVITS-V2_Ollama_洛曦AI数字人
28
@Ikaros
84
684H
更新时间2026-02-24
LiveTalking + GPT-SOVITS V2 + Ollama + FunASR 洛曦AI定制版,实时语音对话数字人 + 直播版数字人
LiveTalking + GPT-SOVITS V2 + Ollama + FunASR 洛曦AI定制版,实时语音对话数字人 + 直播版数字人
0/小时
视频超分
最快AI视频高清修复FlashVSR-支持批量生成
最快AI视频高清修复FlashVSR-支持批量生成
145
@与AI同行
与AI同行认证作者
2691
11016H
更新时间2026-03-31
支持自启动
最快AI视频高清修复FlashVSR
最快AI视频高清修复FlashVSR
0/小时
语音合成语音分离AI音乐
SoulX-Singer
SoulX-Singer
16
@刘悦的技术博客
刘悦的技术博客认证作者
104
109H
更新时间2026-02-27
支持自启动
SoulX-Singer,零样本变声器,AI歌曲翻唱,歌词修改,改歌词,语音内容修改
SoulX-Singer,零样本变声器,AI歌曲翻唱,歌词修改,改歌词,语音内容修改
0/小时
ComfyUIWanQwen-Image
ComfyUI云端整合包2602
ComfyUI云端整合包2602
23
@鹄仙
鹄仙认证作者
239
1409H
更新时间2026-02-13
全面升级到torch2.10+cu130
全面升级到torch2.10+cu130
0/小时
音乐语音分离语音识别
AI音乐制作项目ACE-Step-1.5官方包
AI音乐制作项目ACE-Step-1.5官方包
12
@鹄仙
鹄仙认证作者
92
590H
更新时间2026-02-25
专业级别的AI音乐制作项目
专业级别的AI音乐制作项目
0/小时
AI音乐
ACE-Step-1.5,AI歌曲生成,男女对唱,纯音乐生成
ACE-Step-1.5,AI歌曲生成,男女对唱,纯音乐生成
12
@刘悦的技术博客
刘悦的技术博客认证作者
60
133H
更新时间2026-02-25
支持自启动
ACE-Step-1.5,AI歌曲生成,男女对唱,纯音乐生成
ACE-Step-1.5,AI歌曲生成,男女对唱,纯音乐生成
0/小时
3D生成
UltraShape-1.0
UltraShape-1.0
1
@苍耳阿猫
苍耳阿猫认证作者
22
35H
更新时间2026-02-25
UltraShape-1.0
UltraShape-1.0
0/小时
AI应用视频生成视频编辑
LingBot-World
LingBot-World
0
@敢敢のwings
敢敢のwings认证作者
17
67H
更新时间2026-02-25
蚂蚁集团旗下具身智能公司灵波科技(Robbyant)正式开源了其世界模型 LingBot-World。这一消息发布后迅速登顶全球社交媒体热榜,引发了人工智能领域的广泛关注
蚂蚁集团旗下具身智能公司灵波科技(Robbyant)正式开源了其世界模型 LingBot-World。这一消息发布后迅速登顶全球社交媒体热榜,引发了人工智能领域的广泛关注
0/小时
视频生成
最强AI生成数字人,InfiniteTalk官方版 v260209
最强AI生成数字人,InfiniteTalk官方版 v260209
34
@与AI同行
与AI同行认证作者
477
2746H
更新时间2026-03-31
支持自启动
最强AI生成数字人,InfiniteTalk官方版 v260209,支持图片数字人,支持超长视频、批量队列生成!
最强AI生成数字人,InfiniteTalk官方版 v260209,支持图片数字人,支持超长视频、批量队列生成!
0/小时
ComfyUIIndexTTSWan
comfyui工作站
comfyui工作站
15
@AI绘视玩家
151
1072H
更新时间2026-02-10
支持自启动
集成图片生成|视频生成|数字人|声音编辑|音乐生成!配套Comfyui批量管理生成软件到(B站)【AI绘视玩家】处获取~
集成图片生成|视频生成|数字人|声音编辑|音乐生成!配套Comfyui批量管理生成软件到(B站)【AI绘视玩家】处获取~
0/小时
ComfyUIWan数字人
Comfyui2月最新整合包,含最新klein、Z-image全系、WAN全系、LTX2.0等
Comfyui2月最新整合包,含最新klein、Z-image全系、WAN全系、LTX2.0等
73
@老许爱吃肉丶
355
1507H
更新时间2026-02-25
支持自启动
自用!Comfyui2月最新整合包,含最新klein、Z-image全系、WAN全系、LTX2.0等
自用!Comfyui2月最新整合包,含最新klein、Z-image全系、WAN全系、LTX2.0等
0/小时
语音合成AI音乐
ACE-Step-1.5官方原版,修复吞歌词问题,音乐重构,音乐重绘,AI歌曲生成,男女对唱,纯音乐生成,相关竞品:DiffRhythm/yuE/HeartMuLa
ACE-Step-1.5官方原版,修复吞歌词问题,音乐重构,音乐重绘,AI歌曲生成,男女对唱,纯音乐生成,相关竞品:DiffRhythm/yuE/HeartMuLa
8
@刘悦的技术博客
刘悦的技术博客认证作者
46
42H
更新时间2026-02-25
支持自启动
ACE-Step-1.5官方原版,修复吞歌词问题,音乐重构,音乐重绘,AI歌曲生成,男女对唱,纯音乐生成,相关竞品:DiffRhythm/yuE/HeartMuLa
ACE-Step-1.5官方原版,修复吞歌词问题,音乐重构,音乐重绘,AI歌曲生成,男女对唱,纯音乐生成,相关竞品:DiffRhythm/yuE/HeartMuLa
0/小时
ComfyUI视频生成数字人
LTX2-Rapid-Merges视频生成
LTX2-Rapid-Merges视频生成
53
@AI-KSK
AI-KSK认证作者
280
425H
更新时间2026-02-25
包含了文生、图生、首尾帧、对口型 4 大类工作流,提供SFW/NSFW的完整体验
包含了文生、图生、首尾帧、对口型 4 大类工作流,提供SFW/NSFW的完整体验
0/小时
其他
ROX Quant 3.0 - 量化投研系统可无卡模式运行 投资有风险交易须谨慎
ROX Quant 3.0 - 量化投研系统可无卡模式运行 投资有风险交易须谨慎
5
@鸡你太美
鸡你太美认证作者
13
37H
更新时间2026-04-27
支持自启动
ROX Quant 3.0 - 量化投研系统可无卡模式运行 投资有风险交易须谨慎
ROX Quant 3.0 - 量化投研系统可无卡模式运行 投资有风险交易须谨慎
0/小时
语音合成语音克隆
【Qwen3TTS】声音克隆 音色定制 长文本推理优化镜像
【Qwen3TTS】声音克隆 音色定制 长文本推理优化镜像
17
@两只鸽子
227
463H
更新时间2026-02-25
支持自启动
Qwen3TTS推理镜像
Qwen3TTS推理镜像
0/小时
InfiniteTalk数字人
InfiniteTalk数字人最新官方更新,上下文循环,一致性和速度优化,4步采样,高清放大,批量任务队列,基于comfyui,工作流
InfiniteTalk数字人最新官方更新,上下文循环,一致性和速度优化,4步采样,高清放大,批量任务队列,基于comfyui,工作流
51
@刘悦的技术博客
刘悦的技术博客认证作者
633
890H
更新时间2026-02-06
支持自启动
InfiniteTalk数字人最新官方更新,上下文循环,一致性和速度优化,4步采样,高清放大,批量任务队列,基于comfyui,工作流
InfiniteTalk数字人最新官方更新,上下文循环,一致性和速度优化,4步采样,高清放大,批量任务队列,基于comfyui,工作流
0/小时
语音合成AI音乐
K哥配音工作室(indextts2音色克隆+qwen3-tts音色生成+HeartMuLay音乐生成)
K哥配音工作室(indextts2音色克隆+qwen3-tts音色生成+HeartMuLay音乐生成)
23
@K哥讲AI
K哥讲AI认证作者
320
5275H
更新时间2026-02-05
支持自启动
多功能配音镜像,融合 indextts2.qwen3-tts音色克隆 HeartMuLa音乐生成,支持多角色配音、文本创音色、一键克隆、音乐一键生成,还有 AI 角色分配.基础音色库及多语言.方言配音
多功能配音镜像,融合 indextts2.qwen3-tts音色克隆 HeartMuLa音乐生成,支持多角色配音、文本创音色、一键克隆、音乐一键生成,还有 AI 角色分配.基础音色库及多语言.方言配音
0/小时
ComfyUILTX
ComfyUI云端整合包LTX-2特别版
ComfyUI云端整合包LTX-2特别版
19
@鹄仙
鹄仙认证作者
55
200H
更新时间2026-02-12
支持LTX-2 scail wan2.2系列
支持LTX-2 scail wan2.2系列
0/小时
图片生成Z-Image
red-Z-Image-Base,15步采样,自定义分辨率,文生图,图生图,自动提示词,批量任务
red-Z-Image-Base,15步采样,自定义分辨率,文生图,图生图,自动提示词,批量任务
18
@刘悦的技术博客
刘悦的技术博客认证作者
228
139H
更新时间2026-02-04
支持自启动
red-Z-Image-Base,15步采样,自定义分辨率,文生图,图生图,自动提示词,批量任务
red-Z-Image-Base,15步采样,自定义分辨率,文生图,图生图,自动提示词,批量任务
0/小时
Qwen语音识别
Qwen-ASR
Qwen-ASR
0
@有黑眼圈的小竹熊
25
66H
更新时间2026-02-04
Qwen3-ASR 系列包括 Qwen3-ASR-1.7B 和 Qwen3-ASR-0.6B,支持 52 种语言和方言的语言识别与语音识别(ASR)。
Qwen3-ASR 系列包括 Qwen3-ASR-1.7B 和 Qwen3-ASR-0.6B,支持 52 种语言和方言的语言识别与语音识别(ASR)。
0.3/小时
ComfyUILTX
LTX-2-RapID-GGUF-图生视频-无限时长
LTX-2-RapID-GGUF-图生视频-无限时长
19
@刘悦的技术博客
刘悦的技术博客认证作者
130
224H
更新时间2026-02-04
支持自启动
LTX-2-RapID-GGUF-图生视频-无限时长
LTX-2-RapID-GGUF-图生视频-无限时长
0/小时
ComfyUILTX
LTX-2-RapID-GGUF-图片数字人-无限时长
LTX-2-RapID-GGUF-图片数字人-无限时长
10
@刘悦的技术博客
刘悦的技术博客认证作者
45
53H
更新时间2026-02-05
支持自启动
LTX-2-RapID-GGUF-图片数字人-无限时长
LTX-2-RapID-GGUF-图片数字人-无限时长
0/小时
推理框架Qwen
nano-vllm
nano-vllm
0
@kq123jk6n9
7
35H
更新时间2026-02-03
从0到1,理解vllm的核心内容。包含注释讲解和使用实例,使用教程。帮助大家学习vllm
从0到1,理解vllm的核心内容。包含注释讲解和使用实例,使用教程。帮助大家学习vllm
0.99/小时
ComfyUILTX
LTX2-视频生成最新整个大包(202602)
LTX2-视频生成最新整个大包(202602)
14
@NiuGee
NiuGee认证作者
109
144H
更新时间2026-02-04
支持自启动
震惊!LTX-2开源视频模型,人人都能当导演?牛哥一键整合免费AI创作神器!
震惊!LTX-2开源视频模型,人人都能当导演?牛哥一键整合免费AI创作神器!
0/小时
WanQwen-Image数字人
数字人-语音克隆-wan2.2视频换人换装-Qwen-Image-Edit2509整合包
数字人-语音克隆-wan2.2视频换人换装-Qwen-Image-Edit2509整合包
93
@老徐Ai研习社
老徐Ai研习社认证作者
876
2666H
更新时间2026-02-02
支持自启动
数字人-语音克隆-wan2.2视频换人换装-Qwen-Image-Edit2511整合包
数字人-语音克隆-wan2.2视频换人换装-Qwen-Image-Edit2511整合包
0/小时
OCR识别
LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析
LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析
1
@刘悦的技术博客
刘悦的技术博客认证作者
15
0H
更新时间2026-02-02
支持自启动
LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析
LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析
0/小时
图片生成Z-ImageQwen-Image
最全图片编辑模型大全-qwen2511多角度工作流-flux2-klein-9b全图片编辑模型-z-image-base图片生成模型
最全图片编辑模型大全-qwen2511多角度工作流-flux2-klein-9b全图片编辑模型-z-image-base图片生成模型
29
@匹夫
匹夫认证作者
363
1331H
更新时间2026-02-04
最全图片编辑模型大全-qwen2511多角度工作流-flux2-klein-9b全图片编辑模型-z-image-base图片生成模型
最全图片编辑模型大全-qwen2511多角度工作流-flux2-klein-9b全图片编辑模型-z-image-base图片生成模型
0/小时
Lora训练Z-Image
Z-Image-Base的Lora训练同时支持FluxKlein-AI-TOOLKIT
Z-Image-Base的Lora训练同时支持FluxKlein-AI-TOOLKIT
12
@梦影Erislia
156
1344H
更新时间2026-02-02
Z-Image-Base的Lora训练同时支持FluxKlein-AI-TOOLKIT
Z-Image-Base的Lora训练同时支持FluxKlein-AI-TOOLKIT
0/小时
Lora训练LTXWan
ai-toolkit全能Lora模型训练器
ai-toolkit全能Lora模型训练器
21
@老徐Ai研习社
老徐Ai研习社认证作者
289
2114H
更新时间2026-02-01
支持自启动
支持主流模型lora训练
支持主流模型lora训练
0/小时
图片生成Lora训练
AI图片ZImage模型训练,一键启动WebUI、无需配置
AI图片ZImage模型训练,一键启动WebUI、无需配置
160
@与AI同行
与AI同行认证作者
707
2972H
更新时间2026-03-31
支持自启动
AI图片ZImage模型训练,一键启动WebUI、无需配置
AI图片ZImage模型训练,一键启动WebUI、无需配置
0/小时
图片生成Z-Image
Nunchaku-ZImage极速出图
Nunchaku-ZImage极速出图
5
@Tanjie7
31
4H
更新时间2026-01-30
ZImage Nunchaku版本,已经配置好nunchaku环境,可以直接启动使用comfyui+nunchaku zimage出图
ZImage Nunchaku版本,已经配置好nunchaku环境,可以直接启动使用comfyui+nunchaku zimage出图
0/小时
ComfyUIWan视频生成
2026最新ComfyUI整合包_图片·视频·声音
2026最新ComfyUI整合包_图片·视频·声音
25
@老徐Ai研习社
老徐Ai研习社认证作者
244
4094H
更新时间2026-01-30
支持自启动
2026最新ComfyUI整合包_图片·视频·声音
2026最新ComfyUI整合包_图片·视频·声音
0/小时
图片生成Z-Image
Z-Image-Base,35步采样,文生图,图生图,自动提示词,批量任务
Z-Image-Base,35步采样,文生图,图生图,自动提示词,批量任务
16
@刘悦的技术博客
刘悦的技术博客认证作者
170
236H
更新时间2026-01-29
支持自启动
Z-Image-Base,35步采样,文生图,图生图,自动提示词,批量任务
Z-Image-Base,35步采样,文生图,图生图,自动提示词,批量任务
0/小时
ComfyUI
Comfyui 一张照片制作一个lora训练数据集
Comfyui 一张照片制作一个lora训练数据集
29
@Prompt娄
184
1051H
更新时间2026-01-29
支持自启动
一张照片制作一个角色一致性lora训练数据集
一张照片制作一个角色一致性lora训练数据集
0/小时
Z-Image图片生成
Z-Image
Z-Image
24
@十字鱼
十字鱼认证作者
152
950H
更新时间2026-01-30
支持自启动
Z-Image是一个拥有6B参数的强大且高效的图像生成模型。
Z-Image是一个拥有6B参数的强大且高效的图像生成模型。
0/小时
语音克隆
超级AI语音Qwen3-TTS合集,超强音色克隆、音色设计、情绪控制!
超级AI语音Qwen3-TTS合集,超强音色克隆、音色设计、情绪控制!
52
@与AI同行
与AI同行认证作者
506
1177H
更新时间2026-03-31
支持自启动
超强AI语音生成,Qwen3-TTS整合包合集!超强音色克隆、音色设计、情绪控制,支持音色保存、多音字、超长文本生成。支持批量上传多个文件生成!
超强AI语音生成,Qwen3-TTS整合包合集!超强音色克隆、音色设计、情绪控制,支持音色保存、多音字、超长文本生成。支持批量上传多个文件生成!
0/小时
图片生成Z-Image
Z-Image系列,Base+Tubro反推生图放大一体化
Z-Image系列,Base+Tubro反推生图放大一体化
9
@社恐的知识树
社恐的知识树认证作者
64
282H
更新时间2026-01-28
支持自启动
阿里开源的Z-Image系列模型
阿里开源的Z-Image系列模型
0/小时
DeepSeekOCR识别
DeepSeek-OCR-2
DeepSeek-OCR-2
2
@敢敢のwings
敢敢のwings认证作者
82
4214H
更新时间2026-01-29
DeepSeek-OCR 2 是 DeepSeek 团队开源的新一代 OCR 模型,该模型能够像人类一样带着逻辑去阅读文档。
DeepSeek-OCR 2 是 DeepSeek 团队开源的新一代 OCR 模型,该模型能够像人类一样带着逻辑去阅读文档。
0/小时
ComfyUI
ComfyUI学习版,内置多种基础模型-MumuOpenK
ComfyUI学习版,内置多种基础模型-MumuOpenK
28
@MumuOpenK
553
10642H
更新时间2026-01-29
支持自启动
内置多种基础模型,快速开启comfyui体验
内置多种基础模型,快速开启comfyui体验
0/小时
数字人语音合成语音克隆
AI音乐、声音克隆:顶级数字人长视频套件V2
AI音乐、声音克隆:顶级数字人长视频套件V2
7
@AI-KSK
AI-KSK认证作者
29
34H
更新时间2026-02-11
镜像打通HeartMuLa音乐、Qwen3-TTS音色克隆、InfiniteTalk/LongCat长对话数字人与LTX2视频:写歌配音→照片开口→长时稳成片。
镜像打通HeartMuLa音乐、Qwen3-TTS音色克隆、InfiniteTalk/LongCat长对话数字人与LTX2视频:写歌配音→照片开口→长时稳成片。
0/小时
语音合成Qwen3-TTS
Qwen3-TTS语音模型, | 声音克隆 | 语音定制 | 语音预设 |
Qwen3-TTS语音模型, | 声音克隆 | 语音定制 | 语音预设 |
10
@社恐的知识树
社恐的知识树认证作者
137
115H
更新时间2026-01-27
阿里千问开源的最新语音类模型,显存占用小,生成速度快,支持10种主流语言。
阿里千问开源的最新语音类模型,显存占用小,生成速度快,支持10种主流语言。
0/小时
AI音乐
HeartMuLa-HL,支持中文提示词,无须标签式歌词,更自然的AI歌曲生成,开源版Suno
HeartMuLa-HL,支持中文提示词,无须标签式歌词,更自然的AI歌曲生成,开源版Suno
5
@刘悦的技术博客
刘悦的技术博客认证作者
44
31H
更新时间2026-01-26
支持自启动
HeartMuLa-HL,支持中文提示词,无须标签式歌词,更自然的AI歌曲生成,开源版Suno
HeartMuLa-HL,支持中文提示词,无须标签式歌词,更自然的AI歌曲生成,开源版Suno
0/小时
AI音乐Qwen3-TTS
HeartMula& Qwen3TTS 歌曲生成与语音设计
HeartMula& Qwen3TTS 歌曲生成与语音设计
0
@鹄仙
鹄仙认证作者
11
2H
更新时间2026-01-29
基于HeartMula和Qwen3TTS的歌曲生成与语音设计
基于HeartMula和Qwen3TTS的歌曲生成与语音设计
0/小时
FluxLora训练
Flux.Klein模型Lora训练AI-Toolkit
Flux.Klein模型Lora训练AI-Toolkit
17
@梦影Erislia
162
1125H
更新时间2026-01-26
Flux.Klein模型Lora训练AI-Toolkit
Flux.Klein模型Lora训练AI-Toolkit
0/小时
语音合成Qwen3-TTS
Qwen3-TTS-0.6B,推理速度1比0.5,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
Qwen3-TTS-0.6B,推理速度1比0.5,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
6
@刘悦的技术博客
刘悦的技术博客认证作者
44
25H
更新时间2026-01-26
支持自启动
Qwen3-TTS-0.6B,推理速度1比0.5,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
Qwen3-TTS-0.6B,推理速度1比0.5,音色保存,接口API调用,支持超长文本,支持50系显卡,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
0/小时
语音合成Qwen3-TTS
Qwen3-TTS-语音克隆工作流合集
Qwen3-TTS-语音克隆工作流合集
5
@匹夫
匹夫认证作者
73
86H
更新时间2026-01-26
Qwen3-TTS-语音克隆工作流合集
Qwen3-TTS-语音克隆工作流合集
0/小时
语音合成Qwen3-TTS
Qwen3-TTS捏声音自定义声音tts语音克隆语音克隆声音flash_attn加速版Comfyui工作流版 构建by科哥
Qwen3-TTS捏声音自定义声音tts语音克隆语音克隆声音flash_attn加速版Comfyui工作流版 构建by科哥
15
@鸡你太美
鸡你太美认证作者
173
322H
更新时间2026-04-27
支持自启动
Qwen3-TTS捏声音自定义声音tts语音克隆语音克隆声音flash_attn加速版Comfyui工作流版 构建by科哥
Qwen3-TTS捏声音自定义声音tts语音克隆语音克隆声音flash_attn加速版Comfyui工作流版 构建by科哥
0/小时
语音合成Qwen3-TTS
Qwen3-TTS-1.7B,Flash-Attn加速,音色保存,接口API调用,支持超长文本,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
Qwen3-TTS-1.7B,Flash-Attn加速,音色保存,接口API调用,支持超长文本,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
10
@刘悦的技术博客
刘悦的技术博客认证作者
120
177H
更新时间2026-01-26
支持自启动
Qwen3-TTS-1.7B,Flash-Attn加速,音色保存,接口API调用,支持超长文本,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
Qwen3-TTS-1.7B,Flash-Attn加速,音色保存,接口API调用,支持超长文本,语速调节,音频超分降噪,接入开源阅读,文字转语音,TTS
0/小时
OCR识别
LightOnOCR-2高效的1B参数视觉语言模型用于OCR识别pdf转文本jpg转文本图片转文本 二次开发构建by科哥
LightOnOCR-2高效的1B参数视觉语言模型用于OCR识别pdf转文本jpg转文本图片转文本 二次开发构建by科哥
1
@鸡你太美
鸡你太美认证作者
3
2H
更新时间2026-04-27
支持自启动
LightOnOCR-2高效的1B参数视觉语言模型用于OCR识别pdf转文本jpg转文本图片转文本 二次开发构建by科哥
LightOnOCR-2高效的1B参数视觉语言模型用于OCR识别pdf转文本jpg转文本图片转文本 二次开发构建by科哥
0/小时
Lora训练LTX
LTX2模型Lora训练AI-Toolkit
LTX2模型Lora训练AI-Toolkit
2
@梦影Erislia
22
131H
更新时间2026-01-24
LTX2模型Lora训练AI-Toolkit
LTX2模型Lora训练AI-Toolkit
0/小时
AI音乐
HeartMuLa,AI歌曲生成,开源版Suno
HeartMuLa,AI歌曲生成,开源版Suno
10
@刘悦的技术博客
刘悦的技术博客认证作者
16
9H
更新时间2026-01-23
支持自启动
HeartMuLa,AI歌曲生成,开源版Suno
HeartMuLa,AI歌曲生成,开源版Suno
0/小时
AI音乐
歌曲与音效生成
歌曲与音效生成
3
@老徐Ai研习社
老徐Ai研习社认证作者
19
6H
更新时间2026-01-22
支持自启动
HeartMula根据歌词生成音乐,根据画面生成音效
HeartMula根据歌词生成音乐,根据画面生成音效
0/小时
GLM文本模型
GLM-4.7-Flash
GLM-4.7-Flash
2
@苍耳阿猫
苍耳阿猫认证作者
37
180H
更新时间2026-01-22
GLM-4.7-Flash
GLM-4.7-Flash
0/小时
语音识别
微软开源VibeVoice ASR  TTS集合webui语音到文本 文本到语音模型 二次卡发构建by科哥
微软开源VibeVoice ASR TTS集合webui语音到文本 文本到语音模型 二次卡发构建by科哥
1
@鸡你太美
鸡你太美认证作者
19
4H
更新时间2026-04-27
支持自启动
微软开源VibeVoice ASR TTS集合webui语音到文本 文本到语音模型 二次卡发构建by科哥
微软开源VibeVoice ASR TTS集合webui语音到文本 文本到语音模型 二次卡发构建by科哥
0/小时
视频生成
超强视频替换人物MoCha
超强视频替换人物MoCha
68
@与AI同行
与AI同行认证作者
443
561H
更新时间2026-03-31
支持自启动
最新视频替换人物,MoCha-Preview 整合包,支持视频替换人物,卡通动漫效果更佳,支持添加批量任务, 支持高清修复
最新视频替换人物,MoCha-Preview 整合包,支持视频替换人物,卡通动漫效果更佳,支持添加批量任务, 支持高清修复
0/小时
GLM文本模型
智普开源GLM-4.7-Flash GGUF推理服务编程文本大模型速度很快 webui开发构建by科哥
智普开源GLM-4.7-Flash GGUF推理服务编程文本大模型速度很快 webui开发构建by科哥
2
@鸡你太美
鸡你太美认证作者
27
59H
更新时间2026-04-27
支持自启动
智普开源GLM-4.7-Flash GGUF推理服务编程文本大模型API+webui开发构建by科哥
智普开源GLM-4.7-Flash GGUF推理服务编程文本大模型API+webui开发构建by科哥
0/小时
LTXLora训练
AIToolkit Ltx-2 Lora Training,4090 24G / 48G / 5090 预设多挡位支持
AIToolkit Ltx-2 Lora Training,4090 24G / 48G / 5090 预设多挡位支持
5
@AI-KSK
AI-KSK认证作者
91
1456H
更新时间2026-01-22
基于AI Toolkit,内置4090、48G及5090专属精调预设。告别复杂调参,只需加载对应JSON文件,即可解锁硬件最优性能,零门槛获得专家级训练方案。
基于AI Toolkit,内置4090、48G及5090专属精调预设。告别复杂调参,只需加载对应JSON文件,即可解锁硬件最优性能,零门槛获得专家级训练方案。
0/小时
语音合成
indextts2-IndexTTS2 最新 V23版本的全面升级情感控制更好 构建by科哥
indextts2-IndexTTS2 最新 V23版本的全面升级情感控制更好 构建by科哥
57
@鸡你太美
鸡你太美认证作者
1443
7547H
更新时间2026-04-27
支持自启动
V23版本的全面升级情感控制更好
V23版本的全面升级情感控制更好
0/小时
语音合成
NovaSR一个开源的音频超分辨率模型低音质转高清音质声音修复模型 webui开发构建by科哥
NovaSR一个开源的音频超分辨率模型低音质转高清音质声音修复模型 webui开发构建by科哥
0
@鸡你太美
鸡你太美认证作者
11
3H
更新时间2026-04-27
支持自启动
NovaSR一个开源的音频超分辨率模型低音质转高清音质声音修复模型 webui开发构建by科哥
NovaSR一个开源的音频超分辨率模型低音质转高清音质声音修复模型 webui开发构建by科哥
0/小时
行业模型
sinong南京农业大学开源面向通用农业领域的垂直8B32B全离线模型 webui开发构建by科哥
sinong南京农业大学开源面向通用农业领域的垂直8B32B全离线模型 webui开发构建by科哥
0
@鸡你太美
鸡你太美认证作者
0
0H
更新时间2026-04-27
支持自启动
sinong南京农业大学开源面向通用农业领域的垂直8B32B全离线模型 webui开发构建by科哥
sinong南京农业大学开源面向通用农业领域的垂直8B32B全离线模型 webui开发构建by科哥
0/小时
生物信息行业模型
谷歌最新开源MedGemma医学AI助手 问诊问病例查看CT拍片x光拍片病理答疑问 webui开发构建by科哥
谷歌最新开源MedGemma医学AI助手 问诊问病例查看CT拍片x光拍片病理答疑问 webui开发构建by科哥
1
@鸡你太美
鸡你太美认证作者
16
43H
更新时间2026-04-27
支持自启动
谷歌最新开源MedGemma医学AI助手 问诊问病例查看CT拍片x光拍片病理答疑问 webui开发构建by科哥
谷歌最新开源MedGemma医学AI助手 问诊问病例查看CT拍片x光拍片病理答疑问 webui开发构建by科哥
0/小时
图片生成GLM
GLM-Image
GLM-Image
1
@十字鱼
十字鱼认证作者
19
4H
更新时间2026-01-19
支持自启动
智谱开源图像生成和编辑模型
智谱开源图像生成和编辑模型
0/小时
视频超分
sora2视频二次高清工作流视频高清修复flashvsr工作流Comfyui工作流 构建by科哥
sora2视频二次高清工作流视频高清修复flashvsr工作流Comfyui工作流 构建by科哥
7
@鸡你太美
鸡你太美认证作者
80
48H
更新时间2026-04-27
支持自启动
sora2视频二次高清工作流视频高清修复flashvsr工作流Comfyui工作流 构建by科哥
sora2视频二次高清工作流视频高清修复flashvsr工作流Comfyui工作流 构建by科哥
0/小时
图片生成Qwen-image
超强AI图片编辑,QwenEdit-2511合集,单图/双图编辑, 超强人脸一致性,精准涂抹编辑、无色差/位移,一键生成24张姿势图、九宫格分镜
超强AI图片编辑,QwenEdit-2511合集,单图/双图编辑, 超强人脸一致性,精准涂抹编辑、无色差/位移,一键生成24张姿势图、九宫格分镜
96
@与AI同行
与AI同行认证作者
1246
3384H
更新时间2026-03-31
支持自启动
超强AI图片编辑,QwenEdit-2511合集,单图/双图编辑, 超强人脸一致性,精准涂抹编辑、无色差/位移,一键生成24张姿势图、九宫格分镜
超强AI图片编辑,QwenEdit-2511合集,单图/双图编辑, 超强人脸一致性,精准涂抹编辑、无色差/位移,一键生成24张姿势图、九宫格分镜
0/小时
FluxComfyUI图片生成
FLUX2-Klein-黑森林开源最强编辑模型,秒级生图,效果可控!
FLUX2-Klein-黑森林开源最强编辑模型,秒级生图,效果可控!
14
@社恐的知识树
社恐的知识树认证作者
144
2809H
更新时间2026-01-19
黑森林团队开源的FLUX2-Klein多功能模型,生成速度快,编辑能力强!
黑森林团队开源的FLUX2-Klein多功能模型,生成速度快,编辑能力强!
0/小时
行业模型
谷歌最新翻译模型TranslateGemma支持全世界50多种语言的翻译文本多语言翻译 二次webui开发 构建by科哥
谷歌最新翻译模型TranslateGemma支持全世界50多种语言的翻译文本多语言翻译 二次webui开发 构建by科哥
0
@鸡你太美
鸡你太美认证作者
7
10H
更新时间2026-04-27
支持自启动
谷歌最新翻译模型TranslateGemma支持全世界50多种语言的翻译文本多语言翻译 二次webui开发 构建by科哥
谷歌最新翻译模型TranslateGemma支持全世界50多种语言的翻译文本多语言翻译 二次webui开发 构建by科哥
0/小时
图片生成AI电商
BananaMall一个 AI 驱动的电商详情页生成的ai工具结合谷歌nano banana谷歌香蕉模型 开发构建by科哥
BananaMall一个 AI 驱动的电商详情页生成的ai工具结合谷歌nano banana谷歌香蕉模型 开发构建by科哥
13
@鸡你太美
鸡你太美认证作者
59
218H
更新时间2026-04-27
支持自启动
BananaMall一个 AI 驱动的电商详情页生成的ai工具结合谷歌nano banana谷歌香蕉模型 开发构建by科哥
BananaMall一个 AI 驱动的电商详情页生成的ai工具结合谷歌nano banana谷歌香蕉模型 开发构建by科哥
0/小时
Z-Image图片生成
全能图片编辑王flux2_klein|Qwen_Image_Edit2511|Z-image-turbo
全能图片编辑王flux2_klein|Qwen_Image_Edit2511|Z-image-turbo
30
@老徐Ai研习社
老徐Ai研习社认证作者
258
6927H
更新时间2026-01-21
支持自启动
全能图片生成与编辑
全能图片生成与编辑
0/小时
目标检测
YOLO26
YOLO26
6
@苍耳阿猫
苍耳阿猫认证作者
39
981H
更新时间2026-01-16
YOLO26
YOLO26
0/小时
具身智能
Alpamayo
Alpamayo
1
@苍耳阿猫
苍耳阿猫认证作者
6
32H
更新时间2026-01-20
Alpamayo 1 是一个预训练推理模型,旨在加速自动驾驶(AV)领域的研发。
Alpamayo 1 是一个预训练推理模型,旨在加速自动驾驶(AV)领域的研发。
0/小时
音乐
NotaGen基于 LLM 范式的高音乐性古典符号化音乐生成模型 二次开发构建by科哥
NotaGen基于 LLM 范式的高音乐性古典符号化音乐生成模型 二次开发构建by科哥
1
@鸡你太美
鸡你太美认证作者
9
11H
更新时间2026-04-27
支持自启动
NotaGen基于 LLM 范式的高音乐性古典符号化音乐生成模型 二次开发构建by科哥
NotaGen基于 LLM 范式的高音乐性古典符号化音乐生成模型 二次开发构建by科哥
0/小时
Wan图片生成视频生成
闪电AI视频、图片生成镜像
闪电AI视频、图片生成镜像
10
@cola
55
55H
更新时间2026-01-16
支持自启动
基于lightx2v框架加速的视频、图片生成服务,快速生成视频图片,基于模型wan2.2、qwen-image、z-image
基于lightx2v框架加速的视频、图片生成服务,快速生成视频图片,基于模型wan2.2、qwen-image、z-image
0.1/小时
Wan视频生成ComfyUI
DaSiWa & Remix:Wan 2.2 双神N版
DaSiWa & Remix:Wan 2.2 双神N版
40
@AI-KSK
AI-KSK认证作者
366
1023H
更新时间2026-01-16
本镜像高度集成 Wan 2.2 视频生成环境,预装社区领先四套核心工作流,融合 DaSiWa 高保真与 Remix 逻辑优化,提供一站式 T2V 文生视频与 I2V 图生视频解决方案。
本镜像高度集成 Wan 2.2 视频生成环境,预装社区领先四套核心工作流,融合 DaSiWa 高保真与 Remix 逻辑优化,提供一站式 T2V 文生视频与 I2V 图生视频解决方案。
0/小时
LTX视频生成
LTX-2 Audio-Video:开源首个 · 音画同步生成
LTX-2 Audio-Video:开源首个 · 音画同步生成
14
@AI-KSK
AI-KSK认证作者
135
327H
更新时间2026-01-21
双官方流程全覆盖:同时支持 ComfyUI 官方 LTX 工作流示例 + Lightricks 官方 ComfyUI-LTXVideo 自定义节点与全部示例工作流
双官方流程全覆盖:同时支持 ComfyUI 官方 LTX 工作流示例 + Lightricks 官方 ComfyUI-LTXVideo 自定义节点与全部示例工作流
0/小时
语音合成AI应用
voice pro给视频做多语言配音翻译克隆特定视频声音 直译视频声音本地化 汉化构建by科哥
voice pro给视频做多语言配音翻译克隆特定视频声音 直译视频声音本地化 汉化构建by科哥
10
@鸡你太美
鸡你太美认证作者
27
11H
更新时间2026-04-27
支持自启动
voice pro给视频做多语言配音翻译克隆特定视频声音 直译视频声音本地化 汉化构建by科哥
voice pro给视频做多语言配音翻译克隆特定视频声音 直译视频声音本地化 汉化构建by科哥
0/小时
LTXLora训练
LTX2官方训练器Lora训练
LTX2官方训练器Lora训练
1
@梦影Erislia
29
109H
更新时间2026-01-21
LTX2官方训练器的lora训练支持,内置模型t2v,小白可以一键运行,也可以根据官方文档进行进阶操作
LTX2官方训练器的lora训练支持,内置模型t2v,小白可以一键运行,也可以根据官方文档进行进阶操作
0/小时
LTX视频生成
ltx-2全能lora运镜comfyui工作流文生视频图生视频一键运行 构建by科哥
ltx-2全能lora运镜comfyui工作流文生视频图生视频一键运行 构建by科哥
7
@鸡你太美
鸡你太美认证作者
45
29H
更新时间2026-04-27
支持自启动
ltx-2全能lora运镜comfyui工作流文生视频图生视频一键运行 构建by科哥
ltx-2全能lora运镜comfyui工作流文生视频图生视频一键运行 构建by科哥
0/小时
Qwen-Image
Tongbi-支持Qwen-Image和Qwen-Image-Edit
Tongbi-支持Qwen-Image和Qwen-Image-Edit
49
@十字鱼
十字鱼认证作者
282
8534H
更新时间2026-02-02
支持自启动
阿里通义千问开源最强图像模型,强大的文字渲染能力,强大的图像编辑能力
阿里通义千问开源最强图像模型,强大的文字渲染能力,强大的图像编辑能力
0/小时
其他
nano banana谷歌香蕉在线绘画在线改图修改图片模型香蕉模型
nano banana谷歌香蕉在线绘画在线改图修改图片模型香蕉模型
3
@鸡你太美
鸡你太美认证作者
67
18H
更新时间2026-04-27
支持自启动
nano banana谷歌香蕉在线绘画在线改图修改图片模型香蕉模型
nano banana谷歌香蕉在线绘画在线改图修改图片模型香蕉模型
0/小时
语音合成
【音谷官方】indextts2-api
【音谷官方】indextts2-api
92
@音谷官方
2321
8618H
更新时间2026-04-27
支持自启动
【音谷官方】音谷对应的API
【音谷官方】音谷对应的API
0.2/小时
LTX视频生成
LTX-2 WebUI版
LTX-2 WebUI版
6
@鹄仙
鹄仙认证作者
43
40H
更新时间2026-01-10
基于wangp的LTX-2,WebUI版
基于wangp的LTX-2,WebUI版
0/小时
视频生成
开源版Veo3!LTX2-视频生成合集,文生视频、图生视频、视频人物配音+口型同步、直出1080P,高清细节放大、提示词增强、支持线条+深度+姿势控制!
开源版Veo3!LTX2-视频生成合集,文生视频、图生视频、视频人物配音+口型同步、直出1080P,高清细节放大、提示词增强、支持线条+深度+姿势控制!
59
@与AI同行
与AI同行认证作者
301
211H
更新时间2026-03-31
支持自启动
开源版Veo3!LTX2-视频生成合集,文生视频、图生视频、视频人物配音+口型同步、直出1080P,高清细节放大、提示词增强、支持线条+深度+姿势控制!
开源版Veo3!LTX2-视频生成合集,文生视频、图生视频、视频人物配音+口型同步、直出1080P,高清细节放大、提示词增强、支持线条+深度+姿势控制!
0/小时
LTXComfyUI数字人
 LTX-2:首个开源音画同步生成模型,提示词遵从比肩Sora,理解分镜脚本,一键AI成片!
LTX-2:首个开源音画同步生成模型,提示词遵从比肩Sora,理解分镜脚本,一键AI成片!
9
@社恐的知识树
社恐的知识树认证作者
42
45H
更新时间2026-01-22
LTX-2 是由 Lightricks 开源的 DiT 架构音频-视频基础模型,核心特点是:在同一个模型里同步生成视频与音频,超强提示词理解,支持多镜头脚本,关键词自动匹配视频风格,一键AI成片!
LTX-2 是由 Lightricks 开源的 DiT 架构音频-视频基础模型,核心特点是:在同一个模型里同步生成视频与音频,超强提示词理解,支持多镜头脚本,关键词自动匹配视频风格,一键AI成片!
0/小时
语音合成
Voice Sculptor捏声音基于LLaSA和CosyVoice2的指令化语音合成语音模型 二次开发构建by科哥
Voice Sculptor捏声音基于LLaSA和CosyVoice2的指令化语音合成语音模型 二次开发构建by科哥
4
@鸡你太美
鸡你太美认证作者
18
4H
更新时间2026-04-27
支持自启动
Voice Sculptor捏声音基于LLaSA和CosyVoice2的指令化语音合成语音模型 二次开发构建by科哥
Voice Sculptor捏声音基于LLaSA和CosyVoice2的指令化语音合成语音模型 二次开发构建by科哥
0/小时
Qwen-Image图片生成ComfyUI
LTX-2.0音画同步视频生成|Z-Image-Turbo&Qwen-Image-Edit1图片编辑
LTX-2.0音画同步视频生成|Z-Image-Turbo&Qwen-Image-Edit1图片编辑
12
@老徐Ai研习社
老徐Ai研习社认证作者
63
66H
更新时间2026-02-05
支持自启动
LTX-2.0音画同步视频生成
LTX-2.0音画同步视频生成
0/小时
ComfyUIWan
Comfy二次元跑图生视频DaSiWa和vace跳舞
Comfy二次元跑图生视频DaSiWa和vace跳舞
23
@梦影Erislia
185
376H
更新时间2026-01-22
Comfy二次元跑图生视频DaSiWa和vace跳舞
Comfy二次元跑图生视频DaSiWa和vace跳舞
0/小时
语音识别
SenseVoice多语言语音识别情感识别系统  二次开发构建by科哥
SenseVoice多语言语音识别情感识别系统 二次开发构建by科哥
2
@鸡你太美
鸡你太美认证作者
11
7H
更新时间2026-04-27
支持自启动
SenseVoice多语言语音识别情感识别系统 二次开发构建by科哥
SenseVoice多语言语音识别情感识别系统 二次开发构建by科哥
0/小时
语音识别
FunASR中文语音识别音频转文本声音转文本系统 二次webui开发构建by科哥
FunASR中文语音识别音频转文本声音转文本系统 二次webui开发构建by科哥
2
@鸡你太美
鸡你太美认证作者
25
8H
更新时间2026-04-27
支持自启动
音频声音识别系统
音频声音识别系统
0/小时
语音分离
SAM Audio一个Meta开源的音频分割模型声音分离音频音乐分离应用 二次开发构建by科哥
SAM Audio一个Meta开源的音频分割模型声音分离音频音乐分离应用 二次开发构建by科哥
4
@鸡你太美
鸡你太美认证作者
37
36H
更新时间2026-04-27
支持自启动
可从复杂的音频混合中分离出特定的声音
可从复杂的音频混合中分离出特定的声音
0/小时
图片编辑
UNet Universal Matting基于UNet模型抠图批量抠图 webUI一键抠图 构建by科哥
UNet Universal Matting基于UNet模型抠图批量抠图 webUI一键抠图 构建by科哥
0
@鸡你太美
鸡你太美认证作者
17
43H
更新时间2026-04-27
支持自启动
基于UNet模型抠图批量抠图 webUI一键抠图 构建by科哥
基于UNet模型抠图批量抠图 webUI一键抠图 构建by科哥
0/小时
ComfyUI
ComfyUI_最新26年01月-Niugee-牛哥整合包-V2
ComfyUI_最新26年01月-Niugee-牛哥整合包-V2
25
@NiuGee
NiuGee认证作者
258
540H
更新时间2026-01-08
整合26年最新版本ComfyUI,已下载好常用图像模型,修改端口到7860方便管理界面一键启动
整合26年最新版本ComfyUI,已下载好常用图像模型,修改端口到7860方便管理界面一键启动
0/小时
视频生成
最强AI生成长视频,Wan2.2-SVI2Pro整合包!一次性生成一分钟视频,一次性生成30s分镜视频!
最强AI生成长视频,Wan2.2-SVI2Pro整合包!一次性生成一分钟视频,一次性生成30s分镜视频!
54
@与AI同行
与AI同行认证作者
388
1581H
更新时间2026-03-31
支持自启动
最强AI生成长视频,Wan2.2-SVI2Pro整合包!一次性生成一分钟视频,一次性生成30s分镜视频!
最强AI生成长视频,Wan2.2-SVI2Pro整合包!一次性生成一分钟视频,一次性生成30s分镜视频!
0/小时
ComfyUI
ComfyUI云端整合包2601
ComfyUI云端整合包2601
8
@鹄仙
鹄仙认证作者
71
351H
更新时间2026-01-23
长视频系列升级 不仅仅是SVI2 pro 长视频、LongCat数字人
长视频系列升级 不仅仅是SVI2 pro 长视频、LongCat数字人
0/小时
Qwen-ImageLora训练图片生成
Qwen 2512的Lora训练,内置模型,一键训练AI-Toolkit
Qwen 2512的Lora训练,内置模型,一键训练AI-Toolkit
10
@梦影Erislia
126
699H
更新时间2026-01-23
Qwen 2512的Lora训练,内置模型,一键训练AI-Toolkit
Qwen 2512的Lora训练,内置模型,一键训练AI-Toolkit
0/小时
AI应用
banana-slides基于谷歌人工智能ai制作幻灯片ai制作ppt制作幻灯片 构建by科哥
banana-slides基于谷歌人工智能ai制作幻灯片ai制作ppt制作幻灯片 构建by科哥
3
@鸡你太美
鸡你太美认证作者
19
86H
更新时间2026-04-27
支持自启动
banana-slides基于谷歌人工智能ai制作幻灯片ai制作ppt制作幻灯片 构建by科哥
banana-slides基于谷歌人工智能ai制作幻灯片ai制作ppt制作幻灯片 构建by科哥
0/小时
Qwen-Image图片生成ComfyUI
Qwen-Image-2512模型_QwenVL3反推_SeedVR2放大多合一
Qwen-Image-2512模型_QwenVL3反推_SeedVR2放大多合一
8
@社恐的知识树
社恐的知识树认证作者
93
200H
更新时间2026-01-03
集成千问图像2512模型+QwenVL3图像视频反推API+最强放大SeedVR2多合一工作流,Comfyui-v0.7.0
集成千问图像2512模型+QwenVL3图像视频反推API+最强放大SeedVR2多合一工作流,Comfyui-v0.7.0
0/小时
AI电商
magic-tryon图片视频虚拟试装换装模特换衣 二次webui开发构建by科哥
magic-tryon图片视频虚拟试装换装模特换衣 二次webui开发构建by科哥
3
@鸡你太美
鸡你太美认证作者
56
4H
更新时间2026-04-27
支持自启动
magic-tryon图片视频虚拟试装换装模特换衣
magic-tryon图片视频虚拟试装换装模特换衣
0/小时
AI应用
图文创作神器一句话一张图片生成小红书图文 构建by科哥
图文创作神器一句话一张图片生成小红书图文 构建by科哥
1
@鸡你太美
鸡你太美认证作者
6
4H
更新时间2026-04-27
支持自启动
图文创作神器一句话一张图片生成小红书图文
图文创作神器一句话一张图片生成小红书图文
0/小时
Qwen-Image图片生成
阿里千问开源Qwen-Image-2512图像生成模型 二次开发构建by科哥
阿里千问开源Qwen-Image-2512图像生成模型 二次开发构建by科哥
4
@鸡你太美
鸡你太美认证作者
14
7H
更新时间2026-04-27
支持自启动
需要80gb显存运行该项目
需要80gb显存运行该项目
0/小时
物理模拟分子动力
gromacs_deepmd机器学习训练水分子力场
gromacs_deepmd机器学习训练水分子力场
0
@tty
14
350H
更新时间2026-01-26
内含deepmd机器学习力场训练水分子,gromacs调用运行例子
内含deepmd机器学习力场训练水分子,gromacs调用运行例子
0/小时
物理模拟分子动力
deepmd_lammps训练和运行镜像
deepmd_lammps训练和运行镜像
0
@tty
21
103H
更新时间2026-01-26
内含ch4简单例子,也可用来训练自己的模型,3080ti版本
内含ch4简单例子,也可用来训练自己的模型,3080ti版本
0/小时
混元
HY-Motion1.0腾讯混元开源的文本到3D动作生成模型 汉化构建by科哥
HY-Motion1.0腾讯混元开源的文本到3D动作生成模型 汉化构建by科哥
2
@鸡你太美
鸡你太美认证作者
13
22H
更新时间2026-04-27
HY-Motion1.0腾讯混元开源的文本到3D动作生成模型 汉化构建by科哥
HY-Motion1.0腾讯混元开源的文本到3D动作生成模型 汉化构建by科哥
0/小时
Wan视频编辑
wan2.1-scail动作迁移
wan2.1-scail动作迁移
27
@匹夫
匹夫认证作者
238
381H
更新时间2026-01-26
wan2.1-scail动作迁移
wan2.1-scail动作迁移
0/小时
Qwen-Image图片生成
Qwen‑Image‑Edit‑2511-LoRA训练 x AI Toolkit
Qwen‑Image‑Edit‑2511-LoRA训练 x AI Toolkit
6
@AI-KSK
AI-KSK认证作者
126
1250H
更新时间2026-01-01
这是一个集成了 Qwen-Image-Edit-2511模型与 AI Toolkit 训练框架的预配置环境,旨在支持用户高效微调出具备精准图像编辑、风格迁移及多主体一致性能力的定制化 LoRA 模型。
这是一个集成了 Qwen-Image-Edit-2511模型与 AI Toolkit 训练框架的预配置环境,旨在支持用户高效微调出具备精准图像编辑、风格迁移及多主体一致性能力的定制化 LoRA 模型。
0/小时
语音合成
 ChatterBox多语言语音合成语言克隆声音克隆 webui二次开发构建by科哥
ChatterBox多语言语音合成语言克隆声音克隆 webui二次开发构建by科哥
4
@鸡你太美
鸡你太美认证作者
34
31H
更新时间2026-04-27
支持自启动
支持23个国家的语言声音克隆
支持23个国家的语言声音克隆
0/小时
数字人
LatentSync 1.6 纯净版
LatentSync 1.6 纯净版
5
@knzskl
43
345H
更新时间2026-01-26
字节跳动、北京交通大学联合推出的端到端唇形同步框架。Latent Sync利用稳定扩散和TREPA的力量,为动态和逼真的视频生成提供精确的高分辨率唇形同步。
字节跳动、北京交通大学联合推出的端到端唇形同步框架。Latent Sync利用稳定扩散和TREPA的力量,为动态和逼真的视频生成提供精确的高分辨率唇形同步。
0/小时
SDLora训练
SDXL及系列衍生模型训练,内置WD打标编辑,任意C站模型导入,小白也能轻松上手,AI-Toolkit
SDXL及系列衍生模型训练,内置WD打标编辑,任意C站模型导入,小白也能轻松上手,AI-Toolkit
84
@梦影Erislia
1579
10018H
更新时间2025-12-30
SDXL及系列衍生模型训练,内置WD打标编辑,任意C站模型导入,小白也能轻松上手,AI-Toolkit
SDXL及系列衍生模型训练,内置WD打标编辑,任意C站模型导入,小白也能轻松上手,AI-Toolkit
0/小时
视频生成图片生成ComfyUI
启梦光影高质量出图二合一
启梦光影高质量出图二合一
2
@麦子AI
36
105H
更新时间2026-01-28
支持自启动
高质量文生图、图生视频。只适配40系显卡
高质量文生图、图生视频。只适配40系显卡
0.15/小时
Wan视频编辑
StoryMem基于wan2.2逐镜脚本生成高连贯电影级1分钟多镜头叙事视频 二次开发构建by科哥
StoryMem基于wan2.2逐镜脚本生成高连贯电影级1分钟多镜头叙事视频 二次开发构建by科哥
11
@鸡你太美
鸡你太美认证作者
39
20H
更新时间2026-04-27
支持自启动
StoryMem基于wan2.2逐镜脚本生成高连贯电影级1分钟多镜头叙事视频 二次开发构建by科哥
StoryMem基于wan2.2逐镜脚本生成高连贯电影级1分钟多镜头叙事视频 二次开发构建by科哥
0/小时
ComfyUI
ComfyUI学习版_torch_2.8.0
ComfyUI学习版_torch_2.8.0
6
@智绘Store
智绘Store认证作者
49
121H
更新时间2026-03-17
支持自启动
此版本镜像,5090、4090、3090、3080Ti等系列显卡可用,P40显卡不可用
此版本镜像,5090、4090、3090、3080Ti等系列显卡可用,P40显卡不可用
0/小时
ComfyUI
ComfyUI学习版镜像_torch-2.7.1
ComfyUI学习版镜像_torch-2.7.1
10
@智绘Store
智绘Store认证作者
29
100H
更新时间2026-03-17
支持自启动
ComfyUI学习版镜像_torch-2.7.1,高性价比镜像,可开P40显卡,5090显卡勿用,会报错
ComfyUI学习版镜像_torch-2.7.1,高性价比镜像,可开P40显卡,5090显卡勿用,会报错
0/小时
Qwen-Image
qwen-image工作流合集edit2511-z-image-turbo
qwen-image工作流合集edit2511-z-image-turbo
9
@匹夫
匹夫认证作者
89
190H
更新时间2026-01-27
qwen-image工作流合集
qwen-image工作流合集
0/小时
语音合成
VoxCPM1.5面壁智能开源的端到端语音合成模型附训练lora训练器 构建by科哥
VoxCPM1.5面壁智能开源的端到端语音合成模型附训练lora训练器 构建by科哥
1
@鸡你太美
鸡你太美认证作者
25
23H
更新时间2026-04-27
支持自启动
语音合成模型+训练lora训练器
语音合成模型+训练lora训练器
0/小时
Qwen-ImageLora训练图片生成
Qwen-2511和Z图像的Lora训练AI-TOOLKIT
Qwen-2511和Z图像的Lora训练AI-TOOLKIT
9
@梦影Erislia
57
342H
更新时间2026-01-27
Qwen-2511和Z图像的Lora训练AI-TOOLKIT
Qwen-2511和Z图像的Lora训练AI-TOOLKIT
0/小时
Wan视频生成
Egox任意视频一键转第一人称视角视频基于wan2.1模型 webui二次开发构建by科哥
Egox任意视频一键转第一人称视角视频基于wan2.1模型 webui二次开发构建by科哥
3
@鸡你太美
鸡你太美认证作者
9
8H
更新时间2026-04-27
支持自启动
将任意视频一键转第一人称视角视频
将任意视频一键转第一人称视角视频
0/小时
视频生成图片生成ComfyUI
启梦光影VIP快速出图二合一
启梦光影VIP快速出图二合一
2
@麦子AI
11
155H
更新时间2026-01-27
支持自启动
2s出图,超级快。注意!本镜像需要部署在50系列显卡上。
2s出图,超级快。注意!本镜像需要部署在50系列显卡上。
0.15/小时
数字人
One-to-All-Animation单图片转换动画视频数字人视频动作模仿器 构建by科哥
One-to-All-Animation单图片转换动画视频数字人视频动作模仿器 构建by科哥
1
@鸡你太美
鸡你太美认证作者
11
6H
更新时间2026-04-27
支持自启动
单图片转换动画视频数字人视频动作模仿器
单图片转换动画视频数字人视频动作模仿器
0/小时
数字人
personaLive实时数字人系统
personaLive实时数字人系统
13
@有趣的80后程序员
有趣的80后程序员认证作者
85
208H
更新时间2025-12-27
支持自启动
实时数字人系统,直播室直接生成分身,低延迟
实时数字人系统,直播室直接生成分身,低延迟
0/小时
Qwen-Image图片生成
Qwen-Image-Edit-2511阿里通义推出的全能图像编辑模型 webui二次修改构建by科哥
Qwen-Image-Edit-2511阿里通义推出的全能图像编辑模型 webui二次修改构建by科哥
4
@鸡你太美
鸡你太美认证作者
82
1115H
更新时间2026-04-27
支持自启动
图片编辑模型 一致性更加好 中文支持更好
图片编辑模型 一致性更加好 中文支持更好
0/小时
语音克隆语音合成
超强AI音色克隆,VoxCPM-V1.5,支持超长文本生成、批量生成,支持音色保存、多音字修改、语速调节,速度超快!
超强AI音色克隆,VoxCPM-V1.5,支持超长文本生成、批量生成,支持音色保存、多音字修改、语速调节,速度超快!
30
@与AI同行
与AI同行认证作者
1264
750H
更新时间2026-03-31
支持自启动
超强AI音色克隆,VoxCPM-V1.5,支持超长文本生成、批量生成,支持音色保存、多音字修改、语速调节,速度超快!
超强AI音色克隆,VoxCPM-V1.5,支持超长文本生成、批量生成,支持音色保存、多音字修改、语速调节,速度超快!
0/小时
ComfyUIWanQwen-Image
2025.12全新模型ComfyUI整合包
2025.12全新模型ComfyUI整合包
19
@老徐Ai研习社
老徐Ai研习社认证作者
123
480H
更新时间2025-12-26
支持自启动
ComfyUI2025.12整合包
ComfyUI2025.12整合包
0/小时
ComfyUI
ComfyUI云端整合包2512
ComfyUI云端整合包2512
15
@鹄仙
鹄仙认证作者
71
1432H
更新时间2026-01-27
ComfyUI云端整合包2512 支持Z-Image 混元1.5,新增到63个插件,带文件管理系统
ComfyUI云端整合包2512 支持Z-Image 混元1.5,新增到63个插件,带文件管理系统
0/小时
Qwen-Image视频编辑
千问2511与动作迁移三剑客
千问2511与动作迁移三剑客
3
@鹄仙
鹄仙认证作者
17
33H
更新时间2025-12-27
一个基于Wan2GP的图像编辑与动作迁移视频生成的WebUI项目
一个基于Wan2GP的图像编辑与动作迁移视频生成的WebUI项目
0/小时
Wan视频生成ComfyUI
TurboDiffusion 100–200×加速ComfyUI-Wan图到视频生成
TurboDiffusion 100–200×加速ComfyUI-Wan图到视频生成
16
@AI-KSK
AI-KSK认证作者
143
371H
更新时间2025-12-25
这是一个超快的AI视频生成工具,1分钟就能把图片变成短视频,速度是普通AI的200倍。
这是一个超快的AI视频生成工具,1分钟就能把图片变成短视频,速度是普通AI的200倍。
0/小时
语音合成
VoxCPM1.5雨落版整合包
VoxCPM1.5雨落版整合包
7
@雨落实战
雨落实战认证作者
98
200H
更新时间2025-12-24
支持自启动
VoxCPM1.5的雨落版整合包
VoxCPM1.5的雨落版整合包
0/小时
AI应用图片生成
PromptFill专为AI绘画设计的开源结构化提示词生成工具 构建by科哥
PromptFill专为AI绘画设计的开源结构化提示词生成工具 构建by科哥
2
@鸡你太美
鸡你太美认证作者
8
11H
更新时间2026-04-27
支持自启动
专为AI绘画设计的开源结构化提示词生成工具
专为AI绘画设计的开源结构化提示词生成工具
0/小时
LongCat数字人
最强长视频数字人:LongCat-Avatar尝鲜版,其他热门生图、视频也都备好了!
最强长视频数字人:LongCat-Avatar尝鲜版,其他热门生图、视频也都备好了!
17
@老许爱吃肉丶
68
211H
更新时间2026-01-27
支持自启动
最强长视频数字人:LongCat-Avatar尝鲜版,其他热门生图、视频也都备好了!
最强长视频数字人:LongCat-Avatar尝鲜版,其他热门生图、视频也都备好了!
0.2/小时
LongCat数字人
SOTA级音频驱动数字人-LongCat-Video-Avatar
SOTA级音频驱动数字人-LongCat-Video-Avatar
13
@AI-KSK
AI-KSK认证作者
74
85H
更新时间2026-01-27
实现身份永续、动作自然的数字人生成
实现身份永续、动作自然的数字人生成
0/小时
视频生成数字人
AI数字人LongCatAvatar,超强口型+表情+姿势效果,支持长视频!
AI数字人LongCatAvatar,超强口型+表情+姿势效果,支持长视频!
60
@与AI同行
与AI同行认证作者
385
423H
更新时间2026-03-31
支持自启动
AI数字人LongCatAvatar,超强口型+表情+姿势效果,支持长视频!
AI数字人LongCatAvatar,超强口型+表情+姿势效果,支持长视频!
0/小时
3D生成
SHARP–苹果开源的3D场景生成AI模型图片转3d模型 二次开发构建by科哥
SHARP–苹果开源的3D场景生成AI模型图片转3d模型 二次开发构建by科哥
3
@鸡你太美
鸡你太美认证作者
28
563H
更新时间2026-04-27
支持自启动
SHARP–苹果开源的3D场景生成AI模型图片转3d模型
SHARP–苹果开源的3D场景生成AI模型图片转3d模型
0/小时
GLM语音识别
GLM-ASR智谱开源的语音识别、语音转文本模型  二次开发构建By科哥
GLM-ASR智谱开源的语音识别、语音转文本模型 二次开发构建By科哥
0
@鸡你太美
鸡你太美认证作者
8
1H
更新时间2026-04-27
支持自启动
智谱开源的语音识别语音转文本声音转文本模型
智谱开源的语音识别语音转文本声音转文本模型
0/小时
分子动力生物信息
Rosetta
Rosetta
2
@苍耳阿猫
苍耳阿猫认证作者
3
26H
更新时间2025-12-23
Rosetta
Rosetta
0/小时
AI应用视频生成
Pixelle-Video|一句话生成短视频
Pixelle-Video|一句话生成短视频
9
@鸡你太美
鸡你太美认证作者
42
16H
更新时间2026-04-27
支持自启动
零门槛,零剪辑经验,让视频创作成为一句话的事
零门槛,零剪辑经验,让视频创作成为一句话的事
0/小时
其他
ai小说ai在线写作系统ai智能写作系统 构建by科哥
ai小说ai在线写作系统ai智能写作系统 构建by科哥
7
@鸡你太美
鸡你太美认证作者
23
137H
更新时间2026-04-27
支持自启动
ai小说ai在线写作系统ai智能写作系统
ai小说ai在线写作系统ai智能写作系统
0/小时
Lora训练
ai-toolkit炼丹炉,支持多种常见模型训练,内置多种模型
ai-toolkit炼丹炉,支持多种常见模型训练,内置多种模型
5
@MumuOpenK
78
567H
更新时间2026-01-29
支持自启动
ai-toolkit炼丹炉(汉化版)
ai-toolkit炼丹炉(汉化版)
0.1/小时
语音合成GLM
智谱开源的AI文本转语音模型支持声音克隆GLM-TTS 语音合成系统 二次开发构建by科哥
智谱开源的AI文本转语音模型支持声音克隆GLM-TTS 语音合成系统 二次开发构建by科哥
0
@鸡你太美
鸡你太美认证作者
38
26H
更新时间2026-04-27
支持自启动
智谱开源的AI文本转语音模型支持声音克隆GLM-TTS 语音合成系统 二次开发构建by科哥
智谱开源的AI文本转语音模型支持声音克隆GLM-TTS 语音合成系统 二次开发构建by科哥
0/小时
ComfyUIQwen-Image图片生成
Twinflow双流加速千问生图1秒1张
Twinflow双流加速千问生图1秒1张
5
@smthem
23
14H
更新时间2025-12-20
支持自启动
最快千问生图方法,顶配1秒1张
最快千问生图方法,顶配1秒1张
0/小时
3D生成ComfyUI
Trellis2代一键图片生成3D模型
Trellis2代一键图片生成3D模型
9
@smthem
213
399H
更新时间2025-12-19
支持自启动
一键图片生成3D模型,输出glb和obj格式,带贴图和法线,自动脱底
一键图片生成3D模型,输出glb和obj格式,带贴图和法线,自动脱底
0/小时
Wan视频生成ComfyUI
TurboDiffusion-ultra-fast-wan
TurboDiffusion-ultra-fast-wan
7
@有趣的80后程序员
有趣的80后程序员认证作者
69
107H
更新时间2025-12-18
让阿里wan模型的视频生成速度提升200倍
让阿里wan模型的视频生成速度提升200倍
0/小时
语音合成
cosyvoce3阿里最新开源声音克隆应用普通话粤语英语日语方言更加精准情感丰富 二次开发构建By科哥
cosyvoce3阿里最新开源声音克隆应用普通话粤语英语日语方言更加精准情感丰富 二次开发构建By科哥
6
@鸡你太美
鸡你太美认证作者
69
79H
更新时间2026-04-27
支持自启动
cosyvoce3阿里最新开源声音克隆应用普通话粤语英语日语方言更加精准情感丰富 二次开发构建By科哥
cosyvoce3阿里最新开源声音克隆应用普通话粤语英语日语方言更加精准情感丰富 二次开发构建By科哥
0/小时
分子动力
cp2k
cp2k
2
@苍耳阿猫
苍耳阿猫认证作者
9
65H
更新时间2025-12-18
cp2k-v2025.2
cp2k-v2025.2
0/小时
语音合成
CosyVoice3,多音字控制,音色保存,接口API调用,流式接口,音频降噪
CosyVoice3,多音字控制,音色保存,接口API调用,流式接口,音频降噪
45
@刘悦的技术博客
刘悦的技术博客认证作者
495
5470H
更新时间2026-01-28
支持自启动
CosyVoice3,多音字控制,音色保存,接口API调用,流式接口,音频降噪
CosyVoice3,多音字控制,音色保存,接口API调用,流式接口,音频降噪
0/小时
ComfyUIAI电商
电商换装到视频-全流程
电商换装到视频-全流程
26
@积木comfyui
171
145H
更新时间2026-01-28
支持自启动
换装-换模特-换姿势-换背景-打光-放大-模特图生视频-全流程
换装-换模特-换姿势-换背景-打光-放大-模特图生视频-全流程
0/小时
分子动力
DeePMD-kit
DeePMD-kit
0
@苍耳阿猫
苍耳阿猫认证作者
4
4H
更新时间2025-12-16
DeePMD-kit-v3.1.2
DeePMD-kit-v3.1.2
0/小时
分子动力
LAMMPS
LAMMPS
3
@苍耳阿猫
苍耳阿猫认证作者
35
306H
更新时间2025-12-16
lammps
lammps
0/小时
Wan视频生成数字人
LiveAvatar
LiveAvatar
9
@十字鱼
十字鱼认证作者
25
20H
更新时间2026-01-28
支持自启动
流式实时音频驱动头像生成,无限长度
流式实时音频驱动头像生成,无限长度
0/小时
AI应用
AI命理预测系统ai算命系统ai大模型算命系统 二次开发构建by科哥
AI命理预测系统ai算命系统ai大模型算命系统 二次开发构建by科哥
1
@鸡你太美
鸡你太美认证作者
18
39H
更新时间2026-04-27
使用最新的ai大模型结合中国传统命理系统开发 可以无卡模式运行这个项目
使用最新的ai大模型结合中国传统命理系统开发 可以无卡模式运行这个项目
0/小时
OCR识别
PaddleOCR-VL
PaddleOCR-VL
23
@十字鱼
十字鱼认证作者
140
481H
更新时间2026-01-28
支持自启动
支持 109 种语言 擅长识别文本、表格、公式和图表
支持 109 种语言 擅长识别文本、表格、公式和图表
0/小时
语音合成GLM
GLM-TTS
GLM-TTS
11
@十字鱼
十字鱼认证作者
45
1223H
更新时间2026-01-28
支持自启动
可控且富有情感表达的零样本TTS
可控且富有情感表达的零样本TTS
0/小时
数字人
知鱼-焕焕镜像
知鱼-焕焕镜像
1
@
10
140H
更新时间2026-01-28
支持自启动
数字人视频生成/Digital Human Video Generation
数字人视频生成/Digital Human Video Generation
0/小时
GLMAI应用
AutoGLM-Phone-9B
AutoGLM-Phone-9B
0
@Ikaros
10
20H
更新时间2025-12-12
支持自启动
AutoGLM-Phone-9B一键启动镜像
AutoGLM-Phone-9B一键启动镜像
0/小时
Wan视频生成
Wan2.2-14B加速版TTP图片放大ttp加速插画图片放大图片高清图片细节放大 科哥构建
Wan2.2-14B加速版TTP图片放大ttp加速插画图片放大图片高清图片细节放大 科哥构建
5
@鸡你太美
鸡你太美认证作者
40
89H
更新时间2026-04-27
支持自启动
专注图片细节放大工作流
专注图片细节放大工作流
0/小时
LongCat图片生成图片编辑
LongCat-Image
LongCat-Image
4
@十字鱼
十字鱼