為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Stability: Stable Audio 3 Small SFX

Stable Audio 3 Small SFX 是一款 4.59 億參數的潛在擴散模型,可根據文字提示生成高品質音效,專為手機與消費級筆記型電腦的裝置端部署而設計。
比較模型
stable-audio-3-small-sfx-text-to-audio
可用Stability音樂非同步
價格
起 $0.0206
模態
音訊

關於 Stable Audio 3 Small SFX

Stable Audio 3 Small SFX 是 Stability AI Stable Audio 3 系列中 Small 層級的音效檢查點(checkpoint)。這是一個擁有 4.59 億參數的潛在擴散模型,用於根據文字生成高品質音效,專為在手機和消費級筆記型電腦上運行而設計。它是專門用於音效的模型。Small Music 涵蓋音樂創作,而 Base 檢查點則用於微調。

適用場景

  • 根據簡單的英文描述生成音效。
  • 支援立體聲輸出及指定時長,適合精確長度的提示音。
  • 根據模型卡(model card)說明,專為在消費級硬體上運行而構建。

其他選擇建議

  • 它不適用於完整的音樂創作;請使用 Small Music 或更大的模型。
  • 音效長度有限,較長的環境音可能需要進行拼接。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    音樂TokenLab 端點
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-sfx-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

音樂

每筆請求
Official 定價
$0.0206
Official
$0.0206
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Stable Audio 3 Small SFX,並準備好編輯或發送提示詞。

協助我使用 stable-audio-3-small-sfx-text-to-audio 透過 /v1/music/generations 執行 music,並顯示結果、狀態與成本。

應用情境

  • 遊戲音效

    根據文字描述創作腳步聲、撞擊聲、拾取聲和介面音效,並為遊戲中的每個提示音選擇所需的精確長度。

  • 影片後製

    透過描述缺失的聲音及其持續時間來填補剪輯中的擬音(foley)和環境音空缺,無需在資料庫中搜尋。

  • 應用程式回饋音效

    為行動裝置或網頁介面生成點擊、確認和警示音,並嘗試同一提示音的多種變體以找到合適的感覺。

  • Podcast 和廣告串場音效

    為 Podcast 和廣告製作短促的轉場、呼嘯聲和撞擊聲,並指定與剪輯間隙相符的長度。

提示詞範例

沉重的木門在石廊中吱呀作響,帶有迴音,5 秒。

科幻介面確認提示音,柔和且音調上升,1 秒。

在礫石上行走,隨後踏上濕草地的腳步聲,中等速度。

FAQ

什麼是 Stable Audio 3 Small SFX?

這是一款來自 Stability AI、專注於音效的輕量級文字轉音訊模型。它是一個潛在擴散模型,旨在於行動電話和消費級筆記型電腦等裝置上部署。

Small SFX 與 Base 版本有何不同?

Base 檢查點缺乏能加速推論並提升品質的對抗性後訓練(adversarial post-training),且主要用於微調。當您想要直接生成音效時,請使用此標準的 Small SFX 模型。

Stable Audio 3 Small SFX 是否產生立體聲音訊?

是的,模型卡說明它會生成立體聲音訊。它接收英文文字提示和以秒為單位的持續時間,因此您可以要求生成符合影片或遊戲場景中精確間隙的音效。

Small SFX 是否也能生成音樂?

其設計目標是音效,因此它並未針對音樂進行調整。若需要音樂創作,請使用 Stable Audio 3 Small Music,或在需要更長或更豐富的樂曲時使用較大的 Stable Audio 3 版本。

Small SFX 可以本地運行嗎?

Stability 表示,當您使用開放權重時,該模型可以在包括近期筆記型電腦在內的消費級硬體上運行。若以服務形式呼叫,則無需您自行託管。

Stable Audio 3 Small SFX 的費用是多少?

在 TokenLab 上,Stable Audio 3 Small SFX 價格為 $0.0206 每筆請求。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Stable Audio 3 Small SFX 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/music/generations 進行 Stable Audio 3 Small SFX 的呼叫。下方的請求範例展示了對應的程式碼格式。

Stable Audio 3 Small SFX 支援哪些操作?

Stable Audio 3 Small SFX 支援 音樂。請在上方選擇一項操作以查看其端點與請求範例。

比較 Stable Audio 3 Small SFX

來源

更新於 2026年10月2日

更多來自 Stable Audio 的模型

相關模型