IndexTTS 2.5 是由哔哩哔哩在2026年发布的最新语音合成模型,在推理速度、多语言支持和情感表达上更进了一步,目前综合实力属于是开源里公认最好的,大家可以按如下教程,在自己的云GPU上自由生成语音体验试试。

以下链接可以免实名注册并送算力点试用 GPU 服务器:

注册链接:https://growthdata.virtaicloud.com/t/xK

登陆后进入项目链接:

https://open.virtaicloud.com/web/project/detail/743132295112519680

点击右上角运行一下,确定克隆项目和数据到自己工作空间,点击立即运行,启动后点右上角进入开发环境。

[图片]

点击开发进入开发环境

[图片]

[图片]

双击打开左侧的 项目说明.ipynb 文件,找到 “二、使用说明:” 下方的 !cd IndexTTS-2.5&&python app.py 这一行命令,点击选中后再点击上面的运行图标运行该命令行,即可启动服务界面:

[图片]

启动大概两分钟,出现 `Running on local URL:http://0.0.0.0:7860 和 Uvicorn running on http://0.0.0.0:10000`,表示启动完成,按下图在右侧添加端口 7860 并将外部链接复制到浏览器新窗口打开,就可以打开 WebUI 界面。

[图片]

[图片]

复制外部的访问链接到浏览器新界面打开即可:

[图片]

使用方式也很简单,在左侧 音频拖放位置,上传参考语音(一般是一分钟内的人声),右侧输入文字即可点击 Synthesize 按钮生成语音。

[图片]

语音合成完毕后,可以直接在页面上播放试听、下载,也可以在项目左侧文件夹里打开 IndexTTS-2.5\outputs 文件夹看到合成后的音频。

[图片]

总的来看,合成速度非常快!几秒钟就完成了一大段对话,一次生成几百上千字的语音也不在话下,懂行的也可以调节下面的TTS参数,或者调整使用 12GB 的算力配置即可运行。最后用完记得点项目右上角停止和销毁来关闭服务器,以节省算力,也可以分享给朋友多注册几个号试用。

[图片]

更多推荐