又一款AI歌曲创作利器:ACE-Step,ACE-Step是刚发布不久的AI自动谱曲AI自动演唱软件,软件在歌曲生成速度、音乐连贯性和可控性上相对同类软件有了较大提升。ACE-Step在3小时前刚发布了新版本,我基于当前最新版本制作了免安装一键启动整合包。

ACE-Step介绍
官方说明:
我们推出 ACE-Step,这是一个用于音乐生成的全新开源基础模型,它克服了现有方法的关键局限性,并通过整体架构设计实现了最佳性能。当前的方法在生成速度、音乐连贯性和可控性之间面临着固有的权衡。例如,基于 LLM 的模型(例如 Yue、SongGen)在歌词对齐方面表现出色,但推理速度慢且存在结构性伪影。另一方面,扩散模型(例如 DiffRhythm)虽然能够实现更快的合成速度,但通常缺乏长距离的结构连贯性。
ACE-Step 通过将基于扩散的生成与 Sana 的深度压缩自动编码器 (DCAE) 和轻量级线性变换器相结合,弥补了这一差距。它进一步利用 MERT 和 m-hubert 在训练过程中对齐语义表征 (REPA),从而实现快速收敛。因此,我们的模型在 A100 GPU 上仅需 20 秒即可合成长达 4 分钟的音乐,比基于 LLM 的基线快 15 倍,同时在旋律、和声和节奏指标上实现了卓越的音乐连贯性和歌词对齐。此外,ACE-Step 保留了细粒度的声学细节,支持语音克隆、歌词编辑、混音和音轨生成(例如,歌词到人声、歌唱到伴奏)等高级控制机制。
我们的愿景并非构建另一个端到端的文本到音乐流程,而是为音乐 AI 构建一个基础模型:一个快速、通用、高效且灵活的架构,使其能够轻松地在其上训练子任务。这为开发强大的工具铺平了道路,这些工具可以无缝集成到音乐艺术家、制作人和内容创作者的创作工作流程中。简而言之,我们的目标是为音乐构建一个稳定的传播时刻。
- 🎸 支持所有主流音乐风格,提供多种描述格式,包括短标签、描述性文字或用例场景
- 🎷 能够使用适当的乐器和风格创作不同类型的音乐
- 🗣️ 支持 19 种语言,其中表现最好的 10 种语言包括:
- 🇺🇸 英语、🇨🇳 中文、🇷🇺 俄语、🇪🇸 西班牙语、🇯🇵 日语、🇩🇪 德语、🇫🇷 法语、🇵🇹 葡萄牙语、🇮🇹 意大利语、🇰🇷 韩语
- ⚠️由于数据不平衡,不太常见的语言可能表现不佳
- 🎹 支持不同流派和风格的各种器乐生成
- 🎺 能够为每种乐器制作具有适当音色和表现力的逼真的乐器曲目
- 🎼 可以使用多种乐器进行复杂的编曲,同时保持音乐的连贯性
- 🎙️ 能够高质量地呈现各种声音风格和技巧
- 🗣️ 支持不同的声音表达,包括各种歌唱技巧和风格
- ⚙️ 使用无需训练、推理时间优化技术实现
- 🌊 流匹配模型生成初始噪声,然后使用 trigFlow 的噪声公式添加额外的高斯噪声
- 🎚️ 可调节原始初始噪声和新高斯噪声之间的混合比,以控制变化程度
- 🖌️ 通过在目标音频输入中添加噪声并在 ODE 过程中应用掩码约束来实现
- 🔍 当输入条件与原始生成不同时,只能修改特定方面,同时保留其余方面
- 🔀 可以与变体生成技术结合,在风格、歌词或人声上创造局部变化
- 💡 创新性地运用流程编辑技术,实现歌词的局部修改,同时保留旋律、人声和伴奏
- 🔄 可与生成的内容和上传的音频配合使用,大大增强了创作可能性
- ℹ️ 当前限制:一次只能修改歌词的一小部分以避免失真,但可以连续应用多个编辑
- 🔊 基于对纯语音数据进行微调的 LoRA,可直接从歌词生成语音样本
- 🛠️ 提供众多实用应用,如人声演示、指南曲目、歌曲创作辅助和人声编排实验
- ⏱️ 提供一种快速测试歌词演唱效果的方法,帮助歌曲创作者更快地进行迭代
- 🎛️ 与 Lyric2Vocal 类似,但针对纯乐器和样本数据进行了微调
- 🎵 能够根据文本描述生成概念音乐制作样本
- 🧰 有助于快速创建乐器循环、音效和音乐元素以供制作
- 🔥 基于纯说唱数据进行微调,打造专门用于说唱生成的 AI 系统
- 🏆 预期功能包括 AI 说唱对决和通过说唱进行叙事表达
- 📚 Rap 具有出色的叙事和表达能力,具有非凡的应用潜力
- 🎚️ 一个基于多轨数据进行训练的控制网-lora,用于生成单独的仪器词干
- 🎯 以参考音轨和指定乐器(或乐器参考音频)作为输入
- 🎹 输出与参考音轨互补的乐器主干,例如为长笛旋律创建钢琴伴奏或为主音吉他添加爵士鼓
- 🔄 StemGen 的逆过程,从单个声乐音轨生成混合主音轨
- 🎵 以声乐曲目和指定风格作为输入,产生完整的声乐伴奏
- 🎸 创建完整的乐器伴奏来补充输入的人声,从而可以轻松地为任何声音录音添加专业的伴奏
ACE-Step整合包使用说明
首先将网盘内的软件压缩包下载到本地电脑上并解压,然后双击启动软件.exe。
高配英伟达显卡选正常模式,低配英伟达显卡选低显存模式。
软件成功启动后会自动打开webui界面。
【Select previous generated input params】选择以前生成的音频使用的参数设置。
【Audio Duration】生成的歌曲时长,最大240秒,-1为随机。
【Format】输出歌曲的音频格式,支持wav,mp3,ogg,flac4种。
【Enable Audio2Audio】启用使用参考音频功能,生成歌曲时长会以参考音频时长为准。
【Preset】音乐风格流派,如流行,嘻哈,古典等。
【Tags】输入想要生成歌曲的描述性标签、类型或场景描述(以逗号分隔),使用关键词female女性和male男性来指定歌曲为女声或男声。
【Lyrics】歌词,支持使用 [verse]、[chorus] 和 [bridge] 等歌词结构标签来区分歌词的不同部分。
使用 [instrumental] 或 [inst] 来生成器乐。不支持在歌词中使用流派结构标签。
【Basic Settings】基本设置,如推理步数,种子
【Advanced Settings】高级设置,调度器类型,如euler,heun,pingpong。2025.05.14更新的功能:新增 Stable Audio Open Small 采样器的pingpong。使用SDE实现更好的音乐一致性和质量,包括歌词对齐和风格对齐。使用更好的方法重新实现Audio2Audio
其它更多设置有感兴趣的可以自行研究测试。
点击【Generate】按钮开始生成歌曲。
还可以对生成的或现有歌曲进行二次修改。
【Retake】使用不同的种子重新生成略有变化的音乐
调整差异,以控制重拍与原作的差异程度
【Repainting】 有选择地重新生成音乐的特定部分
指定要重新绘制的部分的开始和结束时间
选择源音频(text2music输出、上次重新绘制或上传)
【Edit】通过更改标签或歌词修改现有音乐
在“only _ lyrics”模式(保留旋律)或“remix”模式(更改旋律)之间进行选择
调整编辑参数以控制保留多少原始内容
【Extend】在现有乐曲的开头或结尾添加音乐
指定左右延伸长度
选择要扩展的源音频
视频教程及效果演示:https://nuowa.net/1916
注意事项
英伟达显卡显存不低于6G
支持英伟达50系列显卡
英伟达20系列或是英伟达显卡显存较低(如12G以下)电脑建议使用低显存模式
使用前请将英伟达显卡驱动更新到最新版本
只支持Windows 10或11
软件运行路径中不要有非英文字符和空格,待处理文件素材也要注意
AI歌曲生成软件ACE-Step一键启动整合包下载链接
相关推荐
最近更新

pixi包管理器简易教程系列:pypi方法安装pytorch
pytorch可以从conda-forge安装,也可以从Pypi安装,看到目前官方页面上安装命令里已经不提供conda的安装命令了,只有pip命令,所以这里用pypi方式安装。 打开项目文件夹内的pixi.toml文件,添加下面命令要求 执...

pixi包管理器简易教程系列:入门之创建项目及激活虚拟环境
pixi是新一代包管理和环境管理工具,安装python依赖包非常快,用了几次感觉还不错,记录一下个人学习使用pixi的一些经验。 Linux系统安装pixi方法 或是 wget -qO- https://pixi.sh/install.sh...

comfyui视频人物换主体工作流及模型下载
本次分享一个好玩的视频人物换主体工作流,本工作流可以使用一张图片中的主体替换视频中的人物主体。比如抖音上很多热门的猴子炒饭,奥特曼炒饭,猴子vlog等等,都可以使用人物主体替换把原来视频中的人物替换成指定的人物。 comfyui工作流节点使...

github.com镜像加速网站,解决无法访问下载速度慢的问题
github.com是全球最大的开源社区,上面有着大量的优秀的开源应用。特别是当前AI极速发展,各种AI应用层出不穷,极大的方便了我们生活办公。但是由于网络原因,有时候github.com从国内可能无法访问,要么就访问速度极慢,不能方便快捷...

comfyui工作流软件官方原版windows版一键启动整合包下载
comfyui是目前非常热门的一个应用,它使python应用可以图形化以节点的方式直接拖拽使用,使用起来非常方便,而且可以与其他python应用节点配合使用,大大丰富了comfyui的功能,而且网上大量平台可以下载到各种的comfyui工作...

视频人物动作迁移wan2.1 VACE comfyUI工作流及模型下载,一键人物动作复刻
本次分享一个非常好玩的视频人物动作迁移comfyui工作流,可以通过文生视频或图片转视频将视频素材中的人物动作复制到新生成的视频人物中,视频生成模型主要使用了wan2.1 VACE模型。 comfyui工作流节点使用说明 首先打开网盘链接将...

凡人修仙传动画韩立高清图片壁纸素材AI绘画图集
恭迎韩天尊! 祝贺韩天尊顺利结婴! 热门国漫凡人修仙传动画已经更新了5年了,最新一集,主人公韩立顺利结婴,成为一名元婴修士。我属于是比较喜欢看动漫的,看过的动漫估计没过百也得大几十了,热门国漫大多都看过。凡人修仙传算是最喜欢的动漫之一,韩立...

凡人修仙传动画紫灵高清图片壁纸素材AI绘画图集,AI国漫女神系列
凡人修仙传动画乱星海第一美女紫灵是大家非常喜欢的一个角色,动画人物造型精美,是众多女性角色中最受欢迎之一,热度极高。很多人喜欢收集紫灵的图片,但是视频里截图的话可能截不到喜欢的图,下面分享一些紫灵的AI绘画图片素材,图片都是SD生成的,都是...

凡人修仙传动画宋玉高清图片壁纸素材AI绘画图集,AI国漫女神系列
凡人修仙传动画里宋玉是大家比较喜欢的一个角色,动画人物造型精美,当前热度极高。虽然凡人修仙传原著里只是韩老魔的弟子,但是很多短视频创作者非常能整活,已经把宋玉纳入韩老魔后宫了。很多人喜欢收集宋玉的图片,但是视频里截图的话可能截不到喜欢的图,...

凡人修仙传动画人物梅凝高清壁纸素材AI绘画图片,AI国漫女神系列
有些人比较喜欢凡人修仙传动画里梅凝这个角色,视频里截图的话可能截不到喜欢的图,下面分享一些梅凝的AI绘画图片素材,图片都是SD生成的,都是高清大图,非凡人修仙传动画视频截图。部分梅凝图片如下: 图片及模型文件下载链接: https://pa...