每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Stability: Stable Audio 3.0

Stable Audio 3 根据文字描述生成音乐和声音,可按需要生成不同时长的音频,适合项目配乐、器乐创意及音效制作。
对比模型
stable-audio-3
可用Stability音乐异步
价格
起 $0.26
模态
音频

Stable Audio 3.0 简介

Stable Audio 3.0 是 Stability AI 的音频生成模型系列,根据文字描述生成音乐和声音,输出长度可变,返回 MP3 或 WAV。Stability 列出的版本有:面向企业声音制作的 Large、面向完整歌曲的 Medium,以及可在移动设备上生成的 Small 和 Small SFX。你可以按配乐、器乐创意或音效的需要选择时长。

擅长的任务

  • 时长可变,片段可以匹配项目需要的长度。
  • 同一个系列里既有音乐,也有音效。
  • 输出可以是 MP3 或 WAV。

什么情况换别的模型

  • 输出是根据描述生成的器乐和音效,没有针对演唱歌词或特定人声做调优。
  • 需要歌词和人声演唱的歌曲,更适合用专注歌曲的音乐服务。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    音乐TokenLab 端点
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "duration": 30,
      "output_format": "mp3",
      "model": "stable-audio-3",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

价格

每次请求
Official
$0.26每次请求
官方价格
$0.26每次请求

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Stable Audio 3.0 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 stable-audio-3 完成一次 music,接口是 /v1/music/generations。返回结果、状态和费用。

使用场景

  • 配乐底

    生成指定长度的背景音乐,用于视频、游戏菜单或产品演示,再在编辑器里裁剪或循环。

  • 器乐草稿

    在委托作曲家或为项目挑选授权曲目之前,快速尝试流派、速度和情绪方面的想法。

  • 音效

    根据简短的文字描述为场景和界面制作撞击声、环境声和拟音,并选择与所需提示音相符的时长。

  • 原型音频

    给应用或游戏演示填上占位声音,让评审在音效设计师做出最终音频之前,先判断节奏和感觉。

提示词示例

平静的 lo-fi 嘻哈,柔和钢琴加黑胶底噪,90 BPM,45 秒。

史诗管弦预告片的铺垫,铜管渐强,30 秒处戛然而止。

雨打铁皮屋顶,远处有雷声,15 秒。

FAQ

Stable Audio 3.0 是什么?

Stability AI 的文生音频模型系列,可生成音乐和音效。输出长度可变,由你选择时长,系列涵盖从面向录音棚的大型模型到面向移动设备的小型模型。

Stable Audio 3 有哪些规格?

Stability 的页面列出:面向企业声音制作的 Large,面向完整歌曲创作且开放权重的 Medium,以及可在移动设备上生成的 Small 和 Small SFX。Small 检查点也作为独立模型提供。

它返回什么格式?

MP3 和 WAV。MP3 文件小,适合预览和网页使用;WAV 保留未压缩的音频,适合在数字音频工作站或视频时间线里编辑。

可以设置音频长度吗?

可以。可变长度生成是该系列明确提供的功能,所以你直接指定需要的时长,不用事后再裁剪固定长度的片段。让它与你要做的提示音、场景或循环相匹配。

Stable Audio 3.0 能唱歌词吗?

Stability 把该系列描述为根据文字生成音乐和音效,不是以歌词为主的歌曲。需要带歌词的演唱人声时,请改用专门的歌曲生成模型,比如 Suno。

Stable Audio 3.0 的费用是多少?

在 TokenLab 上,Stable Audio 3.0 的价格为 $0.26 每次请求。完整明细见上方价格表。

Stable Audio 3.0 应该使用哪个端点?

Stable Audio 3.0 使用 https://api.tokenlab.sh/v1/music/generations。代码写法见下方的请求示例。

Stable Audio 3.0 支持哪些操作?

Stable Audio 3.0 支持 音乐。选了操作,上面会显示对应的端点和请求示例。

Stable Audio 3.0 对比

资料来源

审阅于 2026年10月2日

更多 Stable Audio 模型

相关模型