Stability: Stable Audio 3 Small Music
stable-audio-3-small-music-text-to-audio- 價格
- 起 $0.0217
- 模態
- 音訊
關於 Stable Audio 3 Small Music
Stable Audio 3 Small Music 是 Stability AI Stable Audio 3 系列中專注於音樂的小型檢查點(checkpoint)。這是一個擁有 4.59 億參數的潛在擴散模型(latent diffusion model),能根據文字提示生成長達兩分鐘的全立體聲作品,且輕量化程度足以在裝置端部署。其同系列的 Small SFX 和 Small SFX Base 則專注於音效。
適用場景
- 根據文字描述生成立體聲音樂,而不僅僅是循環樂段。
- 根據 Stability 的說法,該模型體積小巧,適合裝置端使用,同時能保持較短的生成時間。
- 接受指定長度的英文文字提示。
其他選擇建議
- 輸出長度限制在約兩分鐘,因此較長的作品需要進行拼接。
- 針對更高要求的製作需求,另有較大型的 Stable Audio 3 模型可供選擇。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
音樂TokenLab 端點POST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "model": "stable-audio-3-small-music-text-to-audio", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
定價
Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。
音樂
每筆請求- Official 定價
- $0.0217
- Official
- $0.0217
- 折扣
- —
| Official 定價每筆請求 | Official每筆請求 | 折扣 | |
|---|---|---|---|
| 音樂 | $0.0217 | $0.0217 | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Stable Audio 3 Small Music,並準備好編輯或發送提示詞。
協助我使用 stable-audio-3-small-music-text-to-audio 透過 /v1/music/generations 執行 music,並顯示結果、狀態與成本。
應用情境
遊戲與應用程式音樂
為選單、關卡和引導流程生成所需長度的循環樂段與主題,然後挑選符合您產品氛圍的錄音版本。
影片背景音樂
為短片、解說影片或社群影片製作立體聲背景音樂,並指定持續時間,使音軌與剪輯長度完美契合。
創意草圖繪製
在決定是否委託作曲家或授權現成音軌之前,先在幾秒鐘內為情緒、流派或配器進行原型設計。
輕量級創意工具
圍繞著 Stability 設計的模型構建創意應用程式,該模型可在普通硬體上運行,且提示詞與結果之間的等待時間很短。
提示詞範例
溫暖的民謠風格,配有指彈吉他和輕快打擊樂,100 BPM,60 秒。
深沉的環境音效,伴隨緩慢的脈衝低音和遠處的鐘聲。
輕快活潑的 8-bit 晶片音樂關卡主題。
FAQ
什麼是 Stable Audio 3 Small Music?
這是一款緊湊型的 Stable Audio 3 模型,可根據英文文字提示生成完整的立體聲音樂作品。它是一個潛在擴散模型,輕量化程度足以在裝置端部署。
Small Music 的音軌長度最長是多少?
作品長度最長可達兩分鐘。較長的作品需要由多個生成片段拼接而成,或者使用較大型的 Stable Audio 3 模型(例如 Medium,Stability 將其定位為用於製作完整歌曲)。
Small Music 與 Small SFX 有何不同?
Small Music 針對音樂作品,而 Small SFX 則針對音效進行了調整。它們具有相同的緊湊尺寸和相同的文字提示方式,因此請根據您需要的音訊類型進行選擇,而非根據介面。
Small Music 是開放權重(open-weight)的嗎?
Stability 在 Hugging Face 上以其社群授權(Community License)發布了 Small 檢查點,商業使用條款請參閱其授權頁面。透過 API 使用模型與自行運行權重是兩回事。
Small Music 是使用什麼資料訓練的?
模型卡片描述了來自 AudioSparx 和 Freesound 的錄音,並透過自動檢測過濾掉了受版權保護的音樂。它還註明了一個預訓練的 T5Gemma 文字編碼器,該編碼器有其獨立的使用條款。
Stable Audio 3 Small Music 的費用是多少?
在 TokenLab 上,Stable Audio 3 Small Music 價格為 $0.0217 每筆請求。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Stable Audio 3 Small Music 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/music/generations 進行 Stable Audio 3 Small Music 的呼叫。下方的請求範例展示了對應的程式碼格式。
Stable Audio 3 Small Music 支援哪些操作?
Stable Audio 3 Small Music 支援 音樂。請在上方選擇一項操作以查看其端點與請求範例。
比較 Stable Audio 3 Small Music
來源
更新於 2026年10月2日