DiffRhythm是首个基于扩散技术的开源音乐生成模型,能够创作完整的歌曲,包括AI谱曲,AI演唱。基于当前最新V1.2版本我制作了免安装一键启动整合包。

DiffRhythm介绍
Di♪♪Rhythm:速度惊人、简单至极、具有潜在扩散的端到端全长歌曲生成
DiffRhythm(中文名:谛韵,Dì Yùn)是首个基于扩散技术的开源音乐生成模型,能够创作完整的歌曲。其名称由“Diff”(指其扩散架构)和“Rhythm”(强调其对音乐和歌曲创作的专注)组成。中文名“谛韵”与“DiffRhythm”谐音,“谛”(专注聆听)象征着听觉感知,“韵”(旋律魅力)则代表着音乐性。
更新说明:
- 2025.5.9 🔥 DiffRhythm-v1.2 正式发布!1.2 版本在很大程度上解决了重复和遗漏问题,显著提高了音频质量和编排,乐器更加丰富,并且能够通过对音乐结构和风格的深入了解进行歌曲编辑和延续。
DiffRhythm一键启动整合包使用说明
由于是将歌词文本唱成歌曲,所以软件依赖于文字转语音合成软件espeak-ng,所以使用前先安装网盘内的espeak-ng.msi,双击安装,全程默认。
然后将网盘内的软件压缩包下载到本地电脑上并解压。然后双击【启动软件.exe】。
lrc歌词:首先上传lrc格式的歌词文件,lrc内容格式为前面是时间戳后面是歌词文本,不明白的可以随便找个lrc歌词文件打开看看,然后照着样子自己创作歌词。
输出目录就是生成的歌曲保存目录
风格描述:提供文本风格参考(如“爵士乐”或“快节奏摇滚”),通过文本提示控制生成歌曲的风格,可选但能显著影响输出效果。
参考音频:提供参考音频文件路径作为风格模板。从音频中提取风格特征(如节奏、音色),适用于模仿特定歌曲风格。
分块解码:处理长音频时减少内存占用,适合生成长歌曲(如285秒)时开启。
生成音频时长:设置生成音频长度,可选95到285秒,默认95秒。控制歌曲时长,用户按需求选择短版或长版。
模型ID:默认为最新模型DiffRhythm-1_2,使用其它模型的话软件会自动下载模型文件。
生成歌曲数量:一次性生成多少首歌曲
视频教程及效果演示:https://nuowa.net/1834
注意事项
英伟达显卡显存6G以上
支持英伟达50系列显卡
使用前请先将英伟达显卡驱动更新到最新版本
只支持windows10或11
软件运行路径中不要有非英文字符和空格,待使用文件素材同样要注意
AI歌曲生成软件DiffRhythm V1.2整合包下载链接
相关推荐
AI歌曲创作软件YuE整合包下载,一键谱曲演唱音乐生成器
高效可控歌曲生成器ACE-Step一键启动整合包,音乐人的歌曲创作利器
阿里千问Qwen3-TTS声音克隆语音合成软件【低配电脑版】
阿里Qwen3-TTS高质量声音克隆语音合成系统,AI视频配音多人对话生成工具
多人对话有声书制作软件VoxCPM Windows版整合包,高质量声音克隆语音合成工具
【免安装/解压即用】支持600+语言的神级TTS!OmniVoice 零样本语音克隆一键整合包发布
FunASR语音识别转文字软件区分说话人版
FunASR最新模型FunAudioLLM/Fun-ASR-Nano-2512实时语音识别转文字热词版整合包下载
最近更新
PDF转Markdown软件MinerU 3.1.11整合包(高性能版)
MinerU是一款非常热门的PDF、图片、DOCX、PPTX、XLSX转markdown格式软件,转换效果属于同类软件中比较优秀的一个。当前最新版为3.1.11版本,我基于最新版源码制作了免安装一键启动整合包,并做适当优化及修改,详情查看链...
阿里千问Qwen3-TTS声音克隆语音合成软件【低配电脑版】
阿里千问Qwen3-TTS是一款热门的语音合成及声音克隆软件,我基于当前最新版制作了免安装一键启动整合包,并增加多人对话语音合成功能。 此版本为低配显卡电脑版,软件使用0.6B模型,模型尺寸略小,对电脑显卡配置要求也更小,但是质量不会差太多...

腾讯混元三维世界重建系统WorldMirror 2.0通用3D三维资产重建工具下载
WorldMirror 2.0 是由腾讯混元(Hunyuan)团队开发的下一代通用三维世界重建系统,底层基于 HY-World-2.0 模型。它能够从一组普通照片或一段视频中,自动恢复出场景的三维结构,并生成多种形式的三维资产,包括: 我基...

阿里Qwen3-TTS高质量声音克隆语音合成系统,AI视频配音多人对话生成工具
Qwen3-TTS 是由阿里 Qwen 团队开发的新一代语音合成系统,基于自研的 Qwen3-TTS-Tokenizer-12Hz 编解码器和离散多码本 LM 架构,实现了端到端的全信息语音建模。它突破了传统级联架构的信息瓶颈,支持音色克隆...

PasteMD:一键将 Markdown 和网页 AI 对话文本内容粘贴到 Word、WPS 和 Excel
PasteMD:一键将 Markdown 和网页 AI 对话(ChatGPT/DeepSeek等)完美粘贴到 Word、WPS 和 Excel 的效率工具。 在写论文或报告时,从 ChatGPT / DeepSeek 等 AI 网站中复制出...

BiliNote:自动生成B站油管视频笔记,AI视频内容总结工具
在信息爆炸的时代,视频已经成为最重要的知识载体之一。但相比文字,视频的“可检索性”和“复用效率”始终较低。如何快速从长视频中提取重点、形成结构化知识,成为很多学习者和创作者的痛点。 而 BiliNote 正是为解决这一问题而诞生的一款开源 ...

优云智算HappyHorse AI 视频生成API KEY WebUI
大家可能平常刷视频的时候已经发现了,进入2026年AI短剧极其火爆,不管是短视频平台还是拼多多等购物平台,短剧视频里经常能刷到AI漫剧。前几年短剧公司拍真人短剧赚的盆满钵满,进入2026年短剧公司被AI打的毫无还手之力。借助AI的快速发展,...

LTX-2.3 视频生成免安装部署整合包软件下载
LTX-2 是由 Lightricks 开发的首个基于 DiT(扩散变换器)架构的音视频基础模型,能够在一个统一模型中同时生成高质量的视频与同步音频。与以往需要分别处理视频和音频的方案不同,LTX-2 将两者深度融合,实现真正的音画同步生成...
windows电脑剪贴板内容管理工具Ditto下载,快速粘贴预设文字内容回复话术
和大家分享一个windows电脑剪贴板内容管理神器Ditto,软件可以快速将预设文字内容填充到指定位置。 由于每天都要写大量文字,有时候还是重复内容,频繁到其它地方复制粘贴的话比较耗时间,所以找到了这款软件,首先佩服一下软件作者,这个软件维...
PDF转word软件FreeP2W免安装版下载
这软件还是很早的时候一个用户让做的,发现没分享过,现在分享一下。 软件主要功能就是把PDF文档转换为word文档 软件使用很简单,把需要处理的pdf文档复制到input文件夹内,双击启动软件.exe,等待处理完成即可。 注意事项 软件只支持...













