Stability开源音乐音频生成 多模态模型
Stable Audio(音频生成) Open 1.0
Stable Audio系列 · Stability AI · 2024-06发布
模型介绍
Stability AI 开源的音乐与音效生成模型,根据文本生成音频片段、旋律与音效,可本地运行,适合研究与音乐创作。
模型基础信息
模型系列Stable Audio系列
开发机构Stability AI
发布时间2024-06
参数规模1.1B / 2.1B
上下文窗口文本生成音频
模型类型文本生成音频
中文能力一般
使用方式网页体验 / API调用 / 本地部署
免费额度与收费政策
开源(研究许可)
免费规则详情
开源权重有非商用限制(研究许可)。
收费标准简介
本地免费;商业需授权。
模型能力介绍
✅ 核心优势
- 文本生成音乐/音效
- 本地可运行
- 多种风格支持
- 研究友好
⚠️ 短板与局限
- 权重非商用许可
- 生成时长有限
- 质量与商业模型有差距
🎯 适用场景
- 音效素材生成
- 音乐创作实验
- 声音设计
- 研究项目
模型使用教程
本章节整理 Stable Audio(音频生成) 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。
- 本地:官方 stable-audio-tools 生成。
- 网页:Stability AI 平台(云端版)。
提示词:「upbeat electronic music, 90 BPM, with bass and synth」。
git clone https://github.com/Stability-AI/stable-audio-tools
pip install -e .
运行官方脚本并传入提示词,输出 wav 文件:
python scripts/generate.py --prompt "calm piano music"
git clone https://github.com/Stability-AI/stable-audio-tools
cd stable-audio-tools
pip install -e .
生成示例见官方 generation/ 脚本,传入文本描述生成音频。
💡 使用小技巧
详细描述风格与情绪效果更好。
配合 Stable Audio 工具链做二次开发。
❓ 常见问题 FAQ
Q1:能商用吗?
A1:需注意非商用许可,商用需授权。
Q2:本地能跑吗?
A2:可以,用官方工具链。
访问备注与注意事项
- 权重 hf-mirror 可下
- 注意许可限制
Aitishiku.com