為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Stability: Stable Audio 3 Small Music

Stable Audio 3 Small Music 是一款 4.59 億參數的潛在擴散模型,可根據文字提示生成長達 2 分鐘的完整立體聲音樂作品,輕量級設計足以支援裝置端部署。
比較模型
stable-audio-3-small-music-text-to-audio
可用Stability音樂非同步
價格
起 $0.0217
模態
音訊

關於 Stable Audio 3 Small Music

Stable Audio 3 Small Music 是 Stability AI Stable Audio 3 系列中專注於音樂的小型檢查點(checkpoint)。這是一個擁有 4.59 億參數的潛在擴散模型(latent diffusion model),能根據文字提示生成長達兩分鐘的全立體聲作品,且輕量化程度足以在裝置端部署。其同系列的 Small SFX 和 Small SFX Base 則專注於音效。

適用場景

  • 根據文字描述生成立體聲音樂,而不僅僅是循環樂段。
  • 根據 Stability 的說法,該模型體積小巧,適合裝置端使用,同時能保持較短的生成時間。
  • 接受指定長度的英文文字提示。

其他選擇建議

  • 輸出長度限制在約兩分鐘,因此較長的作品需要進行拼接。
  • 針對更高要求的製作需求,另有較大型的 Stable Audio 3 模型可供選擇。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    音樂TokenLab 端點
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-music-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

音樂

每筆請求
Official 定價
$0.0217
Official
$0.0217
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Stable Audio 3 Small Music,並準備好編輯或發送提示詞。

協助我使用 stable-audio-3-small-music-text-to-audio 透過 /v1/music/generations 執行 music,並顯示結果、狀態與成本。

應用情境

  • 遊戲與應用程式音樂

    為選單、關卡和引導流程生成所需長度的循環樂段與主題,然後挑選符合您產品氛圍的錄音版本。

  • 影片背景音樂

    為短片、解說影片或社群影片製作立體聲背景音樂,並指定持續時間,使音軌與剪輯長度完美契合。

  • 創意草圖繪製

    在決定是否委託作曲家或授權現成音軌之前,先在幾秒鐘內為情緒、流派或配器進行原型設計。

  • 輕量級創意工具

    圍繞著 Stability 設計的模型構建創意應用程式,該模型可在普通硬體上運行,且提示詞與結果之間的等待時間很短。

提示詞範例

溫暖的民謠風格,配有指彈吉他和輕快打擊樂,100 BPM,60 秒。

深沉的環境音效,伴隨緩慢的脈衝低音和遠處的鐘聲。

輕快活潑的 8-bit 晶片音樂關卡主題。

FAQ

什麼是 Stable Audio 3 Small Music?

這是一款緊湊型的 Stable Audio 3 模型,可根據英文文字提示生成完整的立體聲音樂作品。它是一個潛在擴散模型,輕量化程度足以在裝置端部署。

Small Music 的音軌長度最長是多少?

作品長度最長可達兩分鐘。較長的作品需要由多個生成片段拼接而成,或者使用較大型的 Stable Audio 3 模型(例如 Medium,Stability 將其定位為用於製作完整歌曲)。

Small Music 與 Small SFX 有何不同?

Small Music 針對音樂作品,而 Small SFX 則針對音效進行了調整。它們具有相同的緊湊尺寸和相同的文字提示方式,因此請根據您需要的音訊類型進行選擇,而非根據介面。

Small Music 是開放權重(open-weight)的嗎?

Stability 在 Hugging Face 上以其社群授權(Community License)發布了 Small 檢查點,商業使用條款請參閱其授權頁面。透過 API 使用模型與自行運行權重是兩回事。

Small Music 是使用什麼資料訓練的?

模型卡片描述了來自 AudioSparx 和 Freesound 的錄音,並透過自動檢測過濾掉了受版權保護的音樂。它還註明了一個預訓練的 T5Gemma 文字編碼器,該編碼器有其獨立的使用條款。

Stable Audio 3 Small Music 的費用是多少?

在 TokenLab 上,Stable Audio 3 Small Music 價格為 $0.0217 每筆請求。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Stable Audio 3 Small Music 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/music/generations 進行 Stable Audio 3 Small Music 的呼叫。下方的請求範例展示了對應的程式碼格式。

Stable Audio 3 Small Music 支援哪些操作?

Stable Audio 3 Small Music 支援 音樂。請在上方選擇一項操作以查看其端點與請求範例。

比較 Stable Audio 3 Small Music

來源

更新於 2026年10月2日

更多來自 Stable Audio 的模型

相關模型