每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Stability: Stable Audio 3 Small SFX

Stability AI 的 Stable Audio 3 Small SFX Text to Audio 用于音乐或音效生成,已通过 fal 的原生接口完成验证。
对比模型
stable-audio-3-small-sfx-text-to-audio
可用Stability音乐异步
价格
起 $0.0206
模态
音频

Stable Audio 3 Small SFX 简介

Stable Audio 3 Small SFX 是 Stability AI Stable Audio 3 系列 Small 档中的音效检查点。它是一个 4.59 亿参数的潜在扩散模型,能根据文字生成高质量音效,设计目标是在手机和消费级笔记本上运行。需要音效时用它。Small Music 负责音乐作品,Base 检查点则用于微调。

擅长的任务

  • 根据平实的英文描述生成音效。
  • 支持立体声输出和指定时长,适合需要精确长度的音效提示。
  • 据模型卡介绍,可在消费级硬件上运行。

什么情况换别的模型

  • 它不适合生成完整的音乐作品;请用 Small Music 或更大的模型。
  • 音效时长有限,较长的环境底噪可能需要拼接。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    音乐TokenLab 端点
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-sfx-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

音乐

每次请求
官方价格
$0.0206
Official
$0.0206
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Stable Audio 3 Small SFX 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 stable-audio-3-small-sfx-text-to-audio 完成一次 music,接口是 /v1/music/generations。返回结果、状态和费用。

使用场景

  • 游戏音频

    根据文字描述制作脚步声、撞击声、拾取声和界面音效,并为游戏里的每个提示音选定所需的精确时长。

  • 视频后期

    剪辑中缺少拟音和环境声时,直接描述缺的声音和时长来补齐,不用再去素材库里找。

  • 应用反馈音

    为移动端或网页界面生成点击、确认和提醒音,同一个提示音多试几个变体,找到合适的感觉。

  • 播客和广告的过渡音

    制作播客和广告用的短过渡、呼啸声和重音,时长按剪辑中的空档来定。

提示词示例

沉重的木门在石砌走廊里吱呀打开,有回声,5 秒。

科幻界面的确认提示音,柔和并逐渐升高,1 秒。

脚步先踩在碎石上,再踩在湿草地上,中等步速。

FAQ

Stable Audio 3 Small SFX 是什么?

Stability AI 的紧凑型文生音频模型,专注于音效。它是一个潜在扩散模型,设计用于在手机和消费级笔记本上做设备端部署。

Small SFX 和 Base 版本有什么区别?

Base 检查点没有经过加快推理、提升质量的对抗式后训练,是用来微调的。想直接生成音效时,请用这个标准的 Small SFX 模型。

Stable Audio 3 Small SFX 生成立体声吗?

是的,模型卡说明它生成立体声音频。它接受英文文字提示词和以秒为单位的时长,所以你可以让音效正好填上视频或游戏场景里的某个空档。

Small SFX 也能生成音乐吗?

它的设计目标是音效,不是针对音乐调优的。生成音乐作品请用 Stable Audio 3 Small Music;需要更长或更丰满的作品,可以看更大的 Stable Audio 3 条目。

Small SFX 能在本地运行吗?

Stability 表示,使用开放权重时,该模型可以在消费级硬件(包括较新的笔记本)上运行。作为服务调用则无需你自己托管。

Stable Audio 3 Small SFX 的费用是多少?

在 TokenLab 上,Stable Audio 3 Small SFX 的价格为 $0.0206 每次请求。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Stable Audio 3 Small SFX 应该使用哪个端点?

Stable Audio 3 Small SFX 使用 https://api.tokenlab.sh/v1/music/generations。代码写法见下方的请求示例。

Stable Audio 3 Small SFX 支持哪些操作?

Stable Audio 3 Small SFX 支持 音乐。选了操作,上面会显示对应的端点和请求示例。

Stable Audio 3 Small SFX 对比

资料来源

审阅于 2026年10月2日

更多 Stable Audio 模型

相关模型