Stability: Stable Audio 3 Small Music
stable-audio-3-small-music-text-to-audio- 价格
- 起 $0.0217
- 模态
- 音频
Stable Audio 3 Small Music 简介
Stable Audio 3 Small Music 是 Stability AI Stable Audio 3 系列中专注音乐的小型检查点。它是一个 4.59 亿参数的潜在扩散模型,能根据文字提示词生成最长两分钟的完整立体声作品,体量足够轻,可部署到设备端。同系列的 Small SFX 和 Small SFX Base 则专注于音效。
擅长的任务
- 根据文字描述生成立体声音乐,而不只是循环片段。
- 据 Stability 介绍,体量小到可以在设备端使用,生成时间也因此较短。
- 接受英文文字提示词,并可指定时长。
什么情况换别的模型
- 输出最长约两分钟,更长的作品需要拼接。
- 对要求更高的制作工作,还有更大的 Stable Audio 3 模型。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
音乐TokenLab 端点POST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "model": "stable-audio-3-small-music-text-to-audio", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
音乐
每次请求- 官方价格
- $0.0217
- Official
- $0.0217
- 折扣
- —
| 官方价格每次请求 | Official每次请求 | 折扣 | |
|---|---|---|---|
| 音乐 | $0.0217 | $0.0217 | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Stable Audio 3 Small Music 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 stable-audio-3-small-music-text-to-audio 完成一次 music,接口是 /v1/music/generations。返回结果、状态和费用。
使用场景
游戏和应用音乐
按需要的时长生成菜单、关卡和新手引导用的循环和主题曲,再挑选符合产品气质的版本。
视频背景音轨
为短片、讲解视频或社交视频制作立体声音乐底,并指定时长,让音轨与剪辑同时结束。
创意草稿
几秒钟就能做出情绪、流派或配器的原型,再决定是委托作曲家还是购买授权的成品曲目。
轻量创作工具
围绕 Stability 设计为可在普通硬件上运行的模型来搭建创作应用,提示词和结果之间的等待很短。
提示词示例
温暖的原声民谣,指弹吉他加轻打击乐,100 BPM,60 秒。
暗黑氛围的持续低音,低频缓慢脉动,远处有风铃声。
节奏轻快的 8-bit 芯片音乐关卡主题,明亮活泼。
FAQ
Stable Audio 3 Small Music 是什么?
Stable Audio 3 的紧凑型模型,可根据英文文字提示词生成完整的立体声音乐作品。它是一个潜在扩散模型,体量足够轻,可部署在设备端。
Small Music 的曲目最长多长?
作品最长两分钟。更长的作品需要用多次生成拼接,或者用更大的 Stable Audio 3 模型,比如 Stability 定位为完整歌曲的 Medium。
Small Music 和 Small SFX 有什么区别?
Small Music 针对音乐作品,Small SFX 则针对音效做了调优。两者体量同样紧凑,使用文字提示词的方式也相同,所以应根据需要的音频类型来选,而不是根据接口。
Small Music 是开放权重的吗?
Stability 在 Hugging Face 上以其社区许可证发布了 Small 检查点,商用条款见其许可页面。通过 API 使用模型,与自己运行权重是两回事。
Small Music 是用什么数据训练的?
模型卡描述的数据是来自 AudioSparx 和 Freesound 的录音,并用自动检测过滤掉了受版权保护的音乐。模型卡还提到使用了预训练的 T5Gemma 文本编码器,它有自己独立的使用条款。
Stable Audio 3 Small Music 的费用是多少?
在 TokenLab 上,Stable Audio 3 Small Music 的价格为 $0.0217 每次请求。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Stable Audio 3 Small Music 应该使用哪个端点?
Stable Audio 3 Small Music 使用 https://api.tokenlab.sh/v1/music/generations。代码写法见下方的请求示例。
Stable Audio 3 Small Music 支持哪些操作?
Stable Audio 3 Small Music 支持 音乐。选了操作,上面会显示对应的端点和请求示例。
Stable Audio 3 Small Music 对比
资料来源
审阅于 2026年10月2日