每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Stability: Stable Audio 3 Small Music

Stability AI 的 Stable Audio 3 Small Music Text to Audio 用于音乐或音效生成,已通过 fal 的原生接口完成验证。
对比模型
stable-audio-3-small-music-text-to-audio
可用Stability音乐异步
价格
起 $0.0217
模态
音频

Stable Audio 3 Small Music 简介

Stable Audio 3 Small Music 是 Stability AI Stable Audio 3 系列中专注音乐的小型检查点。它是一个 4.59 亿参数的潜在扩散模型,能根据文字提示词生成最长两分钟的完整立体声作品,体量足够轻,可部署到设备端。同系列的 Small SFX 和 Small SFX Base 则专注于音效。

擅长的任务

  • 根据文字描述生成立体声音乐,而不只是循环片段。
  • 据 Stability 介绍,体量小到可以在设备端使用,生成时间也因此较短。
  • 接受英文文字提示词,并可指定时长。

什么情况换别的模型

  • 输出最长约两分钟,更长的作品需要拼接。
  • 对要求更高的制作工作,还有更大的 Stable Audio 3 模型。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    音乐TokenLab 端点
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-music-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

音乐

每次请求
官方价格
$0.0217
Official
$0.0217
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Stable Audio 3 Small Music 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 stable-audio-3-small-music-text-to-audio 完成一次 music,接口是 /v1/music/generations。返回结果、状态和费用。

使用场景

  • 游戏和应用音乐

    按需要的时长生成菜单、关卡和新手引导用的循环和主题曲,再挑选符合产品气质的版本。

  • 视频背景音轨

    为短片、讲解视频或社交视频制作立体声音乐底,并指定时长,让音轨与剪辑同时结束。

  • 创意草稿

    几秒钟就能做出情绪、流派或配器的原型,再决定是委托作曲家还是购买授权的成品曲目。

  • 轻量创作工具

    围绕 Stability 设计为可在普通硬件上运行的模型来搭建创作应用,提示词和结果之间的等待很短。

提示词示例

温暖的原声民谣,指弹吉他加轻打击乐,100 BPM,60 秒。

暗黑氛围的持续低音,低频缓慢脉动,远处有风铃声。

节奏轻快的 8-bit 芯片音乐关卡主题,明亮活泼。

FAQ

Stable Audio 3 Small Music 是什么?

Stable Audio 3 的紧凑型模型,可根据英文文字提示词生成完整的立体声音乐作品。它是一个潜在扩散模型,体量足够轻,可部署在设备端。

Small Music 的曲目最长多长?

作品最长两分钟。更长的作品需要用多次生成拼接,或者用更大的 Stable Audio 3 模型,比如 Stability 定位为完整歌曲的 Medium。

Small Music 和 Small SFX 有什么区别?

Small Music 针对音乐作品,Small SFX 则针对音效做了调优。两者体量同样紧凑,使用文字提示词的方式也相同,所以应根据需要的音频类型来选,而不是根据接口。

Small Music 是开放权重的吗?

Stability 在 Hugging Face 上以其社区许可证发布了 Small 检查点,商用条款见其许可页面。通过 API 使用模型,与自己运行权重是两回事。

Small Music 是用什么数据训练的?

模型卡描述的数据是来自 AudioSparx 和 Freesound 的录音,并用自动检测过滤掉了受版权保护的音乐。模型卡还提到使用了预训练的 T5Gemma 文本编码器,它有自己独立的使用条款。

Stable Audio 3 Small Music 的费用是多少?

在 TokenLab 上,Stable Audio 3 Small Music 的价格为 $0.0217 每次请求。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Stable Audio 3 Small Music 应该使用哪个端点?

Stable Audio 3 Small Music 使用 https://api.tokenlab.sh/v1/music/generations。代码写法见下方的请求示例。

Stable Audio 3 Small Music 支持哪些操作?

Stable Audio 3 Small Music 支持 音乐。选了操作,上面会显示对应的端点和请求示例。

Stable Audio 3 Small Music 对比

资料来源

审阅于 2026年10月2日

更多 Stable Audio 模型

相关模型