Stability开源音乐音频生成 多模态模型

Stable Audio(音频生成) Open 1.0

Stable Audio系列 · Stability AI · 2024-06发布

开源支持本地部署多模态国内可直连有免费额度

模型介绍

Stability AI 开源的音乐与音效生成模型,根据文本生成音频片段、旋律与音效,可本地运行,适合研究与音乐创作。

模型基础信息

模型系列Stable Audio系列
开发机构Stability AI
发布时间2024-06
参数规模1.1B / 2.1B
上下文窗口文本生成音频
模型类型文本生成音频
中文能力一般
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源(研究许可)

免费规则详情

开源权重有非商用限制(研究许可)。

收费标准简介

本地免费;商业需授权。

模型能力介绍

✅ 核心优势

  • 文本生成音乐/音效
  • 本地可运行
  • 多种风格支持
  • 研究友好

⚠️ 短板与局限

  • 权重非商用许可
  • 生成时长有限
  • 质量与商业模型有差距

🎯 适用场景

  • 音效素材生成
  • 音乐创作实验
  • 声音设计
  • 研究项目

模型使用教程

本章节整理 Stable Audio(音频生成) 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 本地:官方 stable-audio-tools 生成。
  • 网页:Stability AI 平台(云端版)。

提示词:「upbeat electronic music, 90 BPM, with bass and synth」。

git clone https://github.com/Stability-AI/stable-audio-tools
pip install -e .

运行官方脚本并传入提示词,输出 wav 文件:

python scripts/generate.py --prompt "calm piano music"
git clone https://github.com/Stability-AI/stable-audio-tools
cd stable-audio-tools
pip install -e .

生成示例见官方 generation/ 脚本,传入文本描述生成音频。

💡 使用小技巧

详细描述风格与情绪效果更好。

配合 Stable Audio 工具链做二次开发。

❓ 常见问题 FAQ

Q1:能商用吗?

A1:需注意非商用许可,商用需授权。

Q2:本地能跑吗?

A2:可以,用官方工具链。

访问备注与注意事项