各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Stability: Stable Audio 3 Small SFX Base

Stable Audio 3 Small SFX Baseは、テキストプロンプトから効果音を生成する4億5900万パラメータの基盤チェックポイントであり、微調整(ファインチューニング)のための未修正のベースとして意図されています。
モデルを比較
stable-audio-3-small-sfx-base-text-to-audio
利用可能Stability音楽非同期
価格
価格 $0.0283
モダリティ
オーディオ

Stable Audio 3 Small SFX Base について

Stable Audio 3 Small SFX Baseは、Stable Audio 3 Small SFXの背後にある未調整の基礎チェックポイントであり、ファインチューニングの出発点としてStability AIによってリリースされました。Stabilityによると、標準モデルが高速かつ高品質な出力のために行っている敵対的ポストトレーニング(事後学習)が施されていないため、直接生成を行う場合は標準のチェックポイントを推奨しています。なお、このモデルでもテキストから効果音を生成することは可能です。

得意なこと

  • 事前学習済みのベースモデルであるため、出力は未調整のモデルの特性を反映します。
  • 生の出力をポストトレーニング済みのSmall SFXと比較するのに役立ちます。
  • 姉妹モデルと同様の効果音特化型で、コンパクトなサイズです。

他のモデルを検討すべきケース

  • 直接生成を行う場合は、標準のSmall SFXの使用が推奨されています。
  • ポストトレーニングが行われていないため、標準モデルよりも生成速度が遅かったり、出力が粗かったりする可能性があります。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    音楽TokenLab エンドポイント
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "model": "stable-audio-3-small-sfx-base-text-to-audio",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

音楽

1リクエストあたり
公式価格
$0.0283
Official
$0.0283
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでStable Audio 3 Small SFX Baseを開き、プロンプトを編集・送信できます。

stable-audio-3-small-sfx-base-text-to-audioと/v1/music/generationsでmusicを実行。結果、ステータス、コストを表示します。

ユースケース

  • 品質比較

    同じプロンプトをこのベースチェックポイントと標準のSmall SFXモデルの両方で生成し、ポストトレーニングによって速度や洗練度がどのように変化するかを確認できます。

  • ベースライン評価

    カスタマイズ前の事前学習済みモデルの挙動を測定し、後のファインチューニング版を既知の出発点と比較して評価できます。

  • 研究用プロンプト

    珍しい音の記述に対して事前学習済みモデルがどのような出力をするかを調査し、どのような種類のエフェクトが得意で、何が苦手かを把握できます。

  • パイプラインテスト

    リクエストの形式が同一で、オーディオ品質に対する期待値が異なる場合に、統合環境が複数のチェックポイントを正しく処理できるかを確認できます。

プロンプト例

タイル張りの床を転がって止まるガラス瓶の音、4秒。

森の上空を通過し、遠ざかっていくヘリコプターの音。

漫画のような誇張されたスプリングの「ボヨヨン」という音、1秒。

FAQ

Stable Audio 3 Small SFX Baseモデルとは何ですか?

Stable Audio 3 Small SFXのベースとなる事前学習済みチェックポイントです。ファインチューニングの未調整の出発点としてリリースされており、ポストトレーニング済みの姉妹モデルと同様に、テキストプロンプトから効果音を生成します。

生成にBaseモデルを使用すべきですか?

通常は推奨されません。Stabilityのモデルカードによると、直接オーディオを生成したい場合はStable Audio 3 Small SFXを使用すべきであり、ベースチェックポイントはファインチューニングを目的とするユーザー向けに提供されています。

Baseチェックポイントには何が欠けていますか?

標準モデルが使用している敵対的ポストトレーニングが施されていません。モデルカードによると、その工程は推論を高速化し品質を向上させるため、標準モデルの方が高速で洗練された結果が得られます。

このAPIを通じてBaseモデルをファインチューニングできますか?

このリストはオーディオ生成のみを行うものであり、学習は行いません。ファインチューニングには、StabilityがHugging FaceでCommunity Licenseのもと公開しているオープンウェイトと、ユーザー自身の学習環境が必要です。

Baseモデルは何を出力しますか?

標準のSmall SFXモデルと同じ形式のリクエストで、テキストプロンプトから生成された効果音を出力します。Stabilityが説明する最終的なポストトレーニング工程をスキップしているため、品質と速度が異なります。

Stable Audio 3 Small SFX Base の料金はいくらですか?

TokenLab では Stable Audio 3 Small SFX Base は $0.0283 1リクエストあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Stable Audio 3 Small SFX Base はどのエンドポイントを使うべきですか?

Stable Audio 3 Small SFX Base のデフォルトは https://api.tokenlab.sh/v1/music/generations です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Stable Audio 3 Small SFX Base はどの操作に対応していますか?

Stable Audio 3 Small SFX Base は 音楽 に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Stable Audio 3 Small SFX Base を比較する

ソース

2026/10/02 時点での評価

Stable Audio の他のモデル

関連モデル