audiocraft - 免费文本转音乐、AI音乐生成、AI音乐创作工具,Facebook开源,本地一键整合包下载

AudioCraft 是一个由Facebook Research开发的PyTorch库,专注于深度学习在音频生成领域的研究。这个强大的工具包集成了两个最新的AI音频生成模型:AudioGen和MusicGen,能够产生高质量的声音和音乐。

今天的一键包也包含了 AudioGen 和 MusicGen 两个部分,主要演示MusicGen,因为MusicGen的模型基本支持了AudioGen的所有功能。

之前也发过过类似的工具,比如 Stable Audio Tools ,同样,audiocraft不仅可以生成各种模拟音频效果,还能减少音损。用户使用该AI工具,只需要在输入文本内容后,即可生成高质量、逼真的音频和音乐。

AudioCraft 使用了两万小时的授权音乐来训练 MusicGen。具体来说,依赖于 10K 高质量音乐曲目的内部数据集,以及 ShutterStock 和 Pond5 音乐数据。

最后,最重要的一点,AudioCraft生成的音乐是可以用于商业用途的,不用担心版权纠纷。

一键包下载:私信 " AI音乐 "

应用场景

音乐创作:使用MusicGen,你可以根据简单的文本指令创造出独一无二的音乐作品。

语音合成:AudioGen可以将文本转化为自然流畅的声音,适用于有声读物或语音助手等领域。

音频压缩与解码:EnCodec提供高效高质的音频编码与解码方案,可用于音频传输和存储优化。

版权保护:AudioSeal的水印技术可对音频内容进行安全标记,防止未经授权的使用

使用教程:

输入提示词,也可手动上传参考音频文件

官方程序提供了10 个预训练模型。

着重介绍以下几个模型:

facebook/musicgen-small : 300M 型号,仅文本到音乐

facebook/musicgen-medium :1.5B 型号,仅文本到音乐

facebook/musicgen-melody : 1.5B 型号,文本转音乐和文本+旋律转音乐

facebook/musicgen-large : 3.3B 型号,仅文本到音乐

facebook/musicgen-melody-large : 3.3B 模型,文本到音乐和文本 + 旋律到音乐

facebook/musicgen-stereo-melody-large :所有以前的型号都针对立体声生成进行了微调 - 小、中、大、旋律、旋律大

如果你的显卡较好,显存12G起,推荐facebook/musicgen-stereo-melody和facebook/musicgen-stereo-melody-large这两个模型,生成的效果是最好的。

如果你的显卡一般,比如8G显存起,可以用 facebook/musicgen-small和facebook/musicgen-medium。

官方推荐 facebook/musicgen-stereo-melody 这个模型,综合能力最好。

考虑到一键包大小,一键包只内置了 facebook/musicgen-stereo-melody 这个模型,如果需要体验其他模型,只需要切换到任意模型,提交的时候后台会自动下载。

也可以单独下载网盘提供的模型包,下载后拷贝到软件根目录下,右键解压到当前文件夹即可。

模型选择好后,选择解码器,设置生成时长,剩下的参数可以默认

最后点击生成即可。

相关推荐
美团技术团队几秒前
美团 LongCat 团队发布全模态一站式评测基准UNO-Bench
人工智能
top_designer12 分钟前
Firefly 样式参考:AI 驱动的 UI 资产“无限”生成
前端·人工智能·ui·aigc·ux·设计师
ACP广源盛1392462567317 分钟前
GSV6127E(EA)#Type-C / 显示端口 1.4/HDMI 2.0 转 MIPI/LVDS 转换器(带音频提取和嵌入式微控制器)
单片机·嵌入式硬件·音视频
强盛小灵通专卖员21 分钟前
Airsim仿真、无人机、无人车、Lidar深度相机应用研究!
人工智能·无人机·sci·深度强化学习·airsim·小论文
MatrixOrigin34 分钟前
矩阵起源成功登陆深圳“专精特新”专板,加速 AI 数据智能新进程!
人工智能
陈天伟教授42 分钟前
人工智能技术- 语音语言- 02 机器诗人
人工智能
却道天凉_好个秋42 分钟前
OpenCV(二十九):高通滤波-索贝尔算子
人工智能·opencv·计算机视觉
用户5191495848451 小时前
Go语言AI智能体开发套件(ADK) - 构建复杂AI代理的开源框架
人工智能·aigc
海底的星星fly2 小时前
【Prompt学习技能树地图】检索增强生成(RAG)核心技术剖析与实践指南
人工智能·语言模型·prompt
AI研一研2 小时前
如何快速学习知识、查找要点、把知识读“薄”、读“精”?
人工智能·学习