為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Stability: Stable Audio 3.0

Stable Audio 3 可根據書面描述生成音樂和聲音。其可變長度的音訊生成功能,適用於將配樂、樂器構想或音效與專案所需的時長進行匹配。
比較模型
stable-audio-3
可用Stability音樂非同步
價格
起 $0.26
模態
音訊

關於 Stable Audio 3.0

Stable Audio 3.0 是 Stability AI 的音訊生成模型系列,可根據文字描述生成音樂和聲音,並支援可變長度輸出。它可輸出 MP3 或 WAV 格式。Stability 將 Large 列為企業級聲音製作,Medium 用於完整歌曲,Small 和 Small SFX 則用於行動裝置生成。您可以選擇持續時間以符合配樂、樂器靈感或音效需求。

適用場景

  • 持續時間可變,因此剪輯長度可以符合專案需求。
  • 在同一個系列中涵蓋了音樂和音效。
  • 輸出格式可為 MP3 或 WAV。

其他選擇建議

  • 輸出為根據描述生成的器樂和音效;它並未針對演唱歌詞或特定人聲進行調整。
  • 若需要歌詞和人聲歌曲,專注於歌曲的音樂服務會更合適。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    音樂TokenLab 端點
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "duration": 30,
      "output_format": "mp3",
      "model": "stable-audio-3",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

定價

每筆請求
Official
$0.26每筆請求
Official 定價
$0.26每筆請求

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Stable Audio 3.0,並準備好編輯或發送提示詞。

協助我使用 stable-audio-3 透過 /v1/music/generations 執行 music,並顯示結果、狀態與成本。

應用情境

  • 背景配樂

    生成指定長度的背景音樂,用於影片、遊戲選單或產品演示,然後在編輯器中進行修剪或循環播放。

  • 器樂草稿

    在委託作曲家或為專案選擇授權曲目之前,快速且低成本地嘗試關於曲風、節奏和情緒的靈感。

  • 音效

    根據簡短的文字描述為場景和介面創作撞擊聲、環境音和擬音,並選擇符合您所需提示音的長度。

  • 音訊原型

    在應用程式或遊戲演示中填入佔位音效,以便審核者在音效設計師製作最終音訊前,評估節奏和感覺。

提示詞範例

平靜的 Lo-fi Hip Hop,柔和的鋼琴與黑膠唱片雜音,90 BPM,45 秒。

史詩管弦樂預告片風格,帶有銅管樂器漸強,並在 30 秒處硬停。

鐵皮屋頂上的雨聲,伴隨遠處的雷聲,15 秒。

FAQ

什麼是 Stable Audio 3.0?

這是 Stability AI 用於音樂和音效的文字轉音訊模型系列。輸出長度可變,因此您可以選擇持續時間;該系列涵蓋了從大型錄音室導向模型到專為行動裝置構建的小型模型。

Stable Audio 3 有哪些尺寸?

Stability 的頁面列出了用於企業聲音製作的 Large、用於完整歌曲創作且具備開放權重的 Medium,以及用於行動裝置生成的 Small 和 Small SFX。Small 檢查點也作為獨立模型提供。

它輸出什麼格式?

MP3 和 WAV。MP3 提供用於預覽和網頁使用的精簡檔案,而 WAV 則保留未壓縮的音訊,適合在數位音訊工作站或影片時間軸中進行編輯。

我可以設定音訊長度嗎?

可以。可變長度生成是該系列的一項既定功能,因此您可以指定所需的持續時間,而不必事後切割固定長度的剪輯。使其與您正在構建的提示音、場景或循環相符。

Stable Audio 3.0 會演唱歌詞嗎?

Stability 將該系列描述為根據文字生成音樂和音效,而非以歌詞為主導的歌曲。如果您需要帶有歌詞的人聲,請選擇專門的歌曲生成模型,例如 Suno。

Stable Audio 3.0 的費用是多少?

在 TokenLab 上,Stable Audio 3.0 價格為 $0.26 每筆請求。完整明細見上方價格表。

Stable Audio 3.0 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/music/generations 進行 Stable Audio 3.0 的呼叫。下方的請求範例展示了對應的程式碼格式。

Stable Audio 3.0 支援哪些操作?

Stable Audio 3.0 支援 音樂。請在上方選擇一項操作以查看其端點與請求範例。

比較 Stable Audio 3.0

來源

更新於 2026年10月2日

更多來自 Stable Audio 的模型

相關模型