每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Stability: Stable Audio 3 Small SFX Base

Stability AI 的 Stable Audio 3 Small SFX Base Text to Audio 用于音乐或音效生成,已通过 fal 的原生接口完成验证。
对比模型
stable-audio-3-small-sfx-base-text-to-audio
可用Stability音乐异步
价格
起 $0.0283
模态
音频

Stable Audio 3 Small SFX Base 简介

Stable Audio 3 Small SFX Base 是 Stable Audio 3 Small SFX 背后未经修改的基础检查点,由 Stability AI 发布,作为微调的起点。Stability 表示它没有经过标准模型所用的对抗式后训练(该步骤让输出更快更好),并建议直接生成时使用标准检查点。它仍然可以根据文字生成音效。

擅长的任务

  • 它是预训练基础模型,输出反映的是未经调整的模型。
  • 可用于对比原始输出与经过后训练的 Small SFX。
  • 与同系列模型一样专注于音效,体量同样紧凑。

什么情况换别的模型

  • Stability 建议直接生成时使用标准的 Small SFX。
  • 没有经过后训练,它可能比标准模型更慢或更粗糙。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    音乐TokenLab 端点
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-sfx-base-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

音乐

每次请求
官方价格
$0.0283
Official
$0.0283
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Stable Audio 3 Small SFX Base 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 stable-audio-3-small-sfx-base-text-to-audio 完成一次 music,接口是 /v1/music/generations。返回结果、状态和费用。

使用场景

  • 质量对比

    用同一个提示词分别在这个基础检查点和标准 Small SFX 模型上生成,听听后训练在速度和精致度上带来了什么变化。

  • 基线评估

    在做任何定制之前,先衡量预训练模型的表现,这样之后的微调版本就能以已知的起点来评判。

  • 研究用提示词

    探测预训练模型对特殊声音描述会生成什么,记录它擅长哪类音效、不擅长哪类。

  • 流水线测试

    检查集成能否处理不止一个检查点:请求格式相同,但对音频质量的预期不同。

提示词示例

玻璃瓶滚过瓷砖地面后停住,4 秒。

远处的直升机飞过森林,声音渐渐消失。

卡通弹簧的“嘣”声,夸张,1 秒。

FAQ

Stable Audio 3 Small SFX Base 模型是什么?

Stable Audio 3 Small SFX 的基础预训练检查点。Stability 将它作为未经修改的微调起点发布,和经过后训练的同系列模型一样,可以根据文字提示词生成音效。

应该用 Base 模型来生成吗?

通常不用。Stability 的模型卡写明,如果想直接生成音频,应该改用 Stable Audio 3 Small SFX,基础检查点是留给打算微调的人用的。

Base 检查点缺少什么?

它没有经过标准模型所用的对抗式后训练。据模型卡介绍,这一步能加快推理并提升质量,所以标准模型预计会更快、更精致。

可以通过这个 API 微调 Base 模型吗?

这个条目只生成音频,不做任何训练。微调需要开放权重(Stability 在 Hugging Face 上以社区许可证发布)以及你自己的训练环境。

Base 模型输出什么?

根据英文文字提示词生成的音效,请求方式与标准 Small SFX 模型相同。由于基础检查点跳过了 Stability 所说的最后的后训练步骤,质量和速度有所不同。

Stable Audio 3 Small SFX Base 的费用是多少?

在 TokenLab 上,Stable Audio 3 Small SFX Base 的价格为 $0.0283 每次请求。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Stable Audio 3 Small SFX Base 应该使用哪个端点?

Stable Audio 3 Small SFX Base 使用 https://api.tokenlab.sh/v1/music/generations。代码写法见下方的请求示例。

Stable Audio 3 Small SFX Base 支持哪些操作?

Stable Audio 3 Small SFX Base 支持 音乐。选了操作,上面会显示对应的端点和请求示例。

Stable Audio 3 Small SFX Base 对比

资料来源

审阅于 2026年10月2日

更多 Stable Audio 模型

相关模型