稳定的音频来了 — 使用人工智能创作音乐(for free)

今天,以稳定扩散(Stable Diffusion)和StableLM等开源AI工具和模型而闻名的Stability AI公司推出了其首个音乐和声音生成AI产品------StableAudio。音乐产业以其难以打入而闻名。即使您拥有才华和动力,您仍然需要创作和制作音乐所需的技能和资源。但如果您一点都不需要这些呢?如果您只需拥有创造力和一个好的AI提示就能创作音乐呢?

StableAudio是一种可以从零开始生成音乐的AI工具。您只需要提供一些简单的指示,AI将完成其余工作。官方链接在这里:https://stableaudio.com/

什么是StableAudio?

StableAudio是一种独创性的AI工具,使用生成式AI技术来创作高质量的音乐和音效。要使用StableAudio,您只需提供一个描述性文本提示和所需的音频长度。例如,您可以输入"后摇、吉他、鼓组、贝斯、弦乐、欢愉、振奋、忧郁、流畅、原始、史诗、感伤、125 BPM"来生成一首95秒的后摇风格曲目。StableAudio非常适合希望在其音乐中创建样本的音乐人。您可以用它来创建音效、背景音乐,甚至是您自己的原创作品。

自己试一试

转到StableAudio仪表板并注册:

StableAudio

然后,转到"生成音乐"仪表板,开始生成您自己的音乐:

StableAudio

输入您的提示并设置持续时间。请注意,免费订阅的音频最大长度为20秒。

点击右箭头按钮开始音频生成。

StableAudio

与此同时,您可以在StableAudio的"用户指南"部分中探索提供的示例:

StableAudio

它是如何工作的

以下是StableAudio工作的一些关键技术细节:

StableAudio技术背景

  • VAE将立体声音频压缩成数据压缩、抗噪和可逆的有损潜在编码,使生成和训练比直接使用原始音频样本更快。

  • 文本编码器用于从文本提示中提取特征。然后,使用这些特征来调节扩散模型。

  • 扩散模型是一个基于U-Net的模型,使用残差层、自注意层和交叉注意层的组合来去噪输入并重构所需的音频。

另一个重要的信息是,StableAudio模型使用了超过800,000个音频文件的数据集,包括音乐、音效和单乐器音轨。这相当于超过19,500小时的音频。

最后的想法

总的来说,我对这个新的AI工具印象深刻。音频的质量与由人类专业人员创造的音频相媲美。StableAudio是一个改变游戏规则的工具,它可能会颠覆整个音乐和音效行业。

· END ·

HAPPY LIFE

本文仅供学习交流使用,如有侵权请联系作者删除

相关推荐
神奇夜光杯1 分钟前
Python酷库之旅-第三方库Pandas(202)
开发语言·人工智能·python·excel·pandas·标准库及第三方库·学习与成长
正义的彬彬侠4 分钟前
《XGBoost算法的原理推导》12-14决策树复杂度的正则化项 公式解析
人工智能·决策树·机器学习·集成学习·boosting·xgboost
Debroon14 分钟前
RuleAlign 规则对齐框架:将医生的诊断规则形式化并注入模型,无需额外人工标注的自动对齐方法
人工智能
羊小猪~~21 分钟前
神经网络基础--什么是正向传播??什么是方向传播??
人工智能·pytorch·python·深度学习·神经网络·算法·机器学习
AI小杨22 分钟前
【车道线检测】一、传统车道线检测:基于霍夫变换的车道线检测史诗级详细教程
人工智能·opencv·计算机视觉·霍夫变换·车道线检测
晨曦_子画26 分钟前
编程语言之战:AI 之后的 Kotlin 与 Java
android·java·开发语言·人工智能·kotlin
道可云28 分钟前
道可云人工智能&元宇宙每日资讯|2024国际虚拟现实创新大会将在青岛举办
大数据·人工智能·3d·机器人·ar·vr
人工智能培训咨询叶梓37 分钟前
探索开放资源上指令微调语言模型的现状
人工智能·语言模型·自然语言处理·性能优化·调优·大模型微调·指令微调
zzZ_CMing37 分钟前
大语言模型训练的全过程:预训练、微调、RLHF
人工智能·自然语言处理·aigc
newxtc38 分钟前
【旷视科技-注册/登录安全分析报告】
人工智能·科技·安全·ddddocr