AI软件下载
有趣网站推荐及实用软件下载

VibeVoice:富有表现力的长篇多人对话语音合成工具整合包下载

VibeVoice是微软开发的一款富有表现力的长篇多人对话语音合成工具。支持1-4个发音人,支持声音克隆自定义音色合成语音,我制作了最新的本地免安装一键启动整合包及云端在线版。

VibeVoice:富有表现力的长篇多人对话语音合成工具整合包下载

VibeVoice介绍

VibeVoice:一种前沿的长对话文本转语音模型

VibeVoice 是一个新型框架,旨在从文本生成富有表现力的长篇多说话人对话音频,例如播客。它解决了传统文本转语音 (TTS) 系统中的重大挑战,尤其是在可扩展性、说话人一致性和自然轮流说话方面。

VibeVoice 的核心创新在于其采用连续语音分词器(声学分词器和语义分词器),并以 7.5 Hz 的超低帧率运行。这些分词器能够高效地保持音频保真度,同时显著提升处理长序列的计算效率。VibeVoice 采用下一词元扩散框架,利用大型语言模型 (LLM) 理解文本上下文和对话流程,并使用扩散头生成高保真声学细节。

该模型可以合成长达90 分钟、最多4 个不同说话人的语音,超越了许多先前模型通常 1-2 个说话人的限制。

VibeVoice整合包使用说明

为了方便有高配电脑和没有高配电脑的用户使用,我分别制作了本地免安装整合包版及云端在线一键启动版。

首先到网盘内将软件压缩包下载到本地电脑上,英伟达显存16G以上用户可下载7B版,低配英伟达显卡用户下载1.5B版,然后解压出来。

双击启动软件.bat,启动成功后会自动打开webUI操作界面

可以选择默认的发音人,也可以自定义音色发音人。

如果需要自定义声音的话,可在上传音频中上传需要使用的声音的音频文件即可。如果需要反复使用这个 声音的话,建议将音频文件放入项目文件夹内的voices文件夹内,在使用的时候直接从列表里选择就可以了,更方便。

脚本输入里输入需要合成语音的文本内容即可。

多人对话时,建议在文本开头写上“Speaker 1:”和“Speaker 2:”这样的关键词来区分不同说话人内容。

点击生成播客,等待合成结果即可。

视频教程及效果演示视频:

注意事项

软件只支持中英文语音合成

本地整合包软件只支持windows10和11

软件运行路径中不要出现非英文字符和空格

英伟达显卡需要RTX30系列或更高型号

7B模型版,建议英伟达显存16G以上用户使用

软件会随机合成一些背景乐,这是由场景决定的,如果想要删除,请修改出现背景乐的文本内容

VibeVoice本地电脑免安装一键启动整合包下载链接

此内容仅限VIP查看,请先
可通过每日签到获得积分兑换VIP

VibeVoice在线一键启动版链接

点击使用云镜像>>

VibeVoice免费在线使用地址

此内容仅限VIP查看,请先
可通过每日签到获得积分兑换VIP

AI软件用不了?2元爽玩4090: 立即体验>>

热门大语言模型API免费体验: 立即获取>>

软件催更及1对1人工答疑支持: https://nuowa.net/1806
赞(4) 打赏
软件无法使用?点击查看常见问题说明>>

最近更新

Studio One Pro 7免费开心版下载-诺瓦小站

Studio One Pro 7免费开心版下载

Studio One 7是一款专业数字音频工作站(DAW)软件,它是音乐制作、混音、母带处理与现场演出一体化的旗舰软件。 ✨ 核心功能 1. AI 智能音轨分离(Stem Separation) AI 驱动的音轨分离功能允许用户将混缩后的音...

优云智算HappyHorse AI 视频生成API KEY WebUI-诺瓦小站

优云智算HappyHorse AI 视频生成API KEY WebUI

大家可能平常刷视频的时候已经发现了,进入2026年AI短剧极其火爆,不管是短视频平台还是拼多多等购物平台,短剧视频里经常能刷到AI漫剧。前几年短剧公司拍真人短剧赚的盆满钵满,进入2026年短剧公司被AI打的毫无还手之力。借助AI的快速发展,...

LTX-2.3 视频生成免安装部署整合包软件下载-诺瓦小站

LTX-2.3 视频生成免安装部署整合包软件下载

LTX-2 是由 Lightricks 开发的首个基于 DiT(扩散变换器)架构的音视频基础模型,能够在一个统一模型中同时生成高质量的视频与同步音频。与以往需要分别处理视频和音频的方案不同,LTX-2 将两者深度融合,实现真正的音画同步生成...

觉得文章对你有帮助就打赏一下作者

非常感谢你的打赏,我将有更多的动力继续提供优质内容,让我们一起创建更加美好的世界!

支付宝扫一扫

微信扫一扫