IndexTTS 2.5雨落版整合包
支持单角色单条数据生成、支持多角色对话生成、支持txt文件批量模式、支持Excel批量模式、支持API端口调用。
和本地版的使用非常相似,只是多了一些批量下载等功能,首页UI如下:

采用了三列式架构,生成按钮在最右边,如下截图:

由于是云端版,这里是采用了批量上传txt的方式。
每个txt文件会对应到一个生成的语音文件。
可以单个下载,也可以批量打成一个zip包下载。

多角色对话模式依然是三列式架构,需要说明的是,这里的对话使用冒号区分角色和具体的文本内容。如下所示:

Excel模式这里有些复杂,需要先把语音上传到resources目录下的prompt_audio目录中,然后使用页面还是比较简单的,如下所示:

API模式需要访问对应ip的9000端口,支持两种风格的文档,如下:

参考官方环境,PyTorch为2.8.0,cuda为12.8。
支持自启动,如需手动启动,也可以先kill原有进程,然后启动/workspace中的app.py即可。
访问7860端口,如果成功,表示环境运行成功。
如需查看日志,请查看/workspace下的log.txt文件查看启动进度。
看到下面的Running on local URL: http://0.0.0.0:7860 这条日志,说明启动成功,截图如下:

在线使用教程: https://wcnn68ei31q6.feishu.cn/wiki/G0Ttw9pi5i5xFOkc5eCcUS5wnTc
性能评测:
https://wcnn68ei31q6.feishu.cn/wiki/V3N3wWfOpifqwjkv22HcgZ9UnAU
Q1: 生成的语音默认会保存在哪里?
A1: 默认会保存在outputs目录中。
