各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Stability: Stable Audio 3.0

Stable Audio 3は、記述されたテキストから音楽やサウンドを生成します。可変長の音声生成機能は、プロジェクトに必要な長さに合わせてサウンドトラック、楽器のアイデア、または効果音を合わせるのに役立ちます。
モデルを比較
stable-audio-3
利用可能Stability音楽非同期
価格
価格 $0.26
モダリティ
オーディオ

Stable Audio 3.0 について

Stable Audio 3.0は、テキスト記述から音楽や音声を生成するStability AIのオーディオ生成モデルファミリーで、可変長の出力を提供します。MP3またはWAV形式で出力されます。Stabilityは、エンタープライズ向けの音響制作にはLarge、フル楽曲にはMedium、モバイル端末での生成にはSmallおよびSmall SFXを挙げています。サウンドトラック、楽器のアイデア、またはエフェクトに合わせて長さを選択できます。

得意なこと

  • 長さは可変であるため、プロジェクトが必要とする長さにクリップを合わせることができます。
  • 一つのファミリーで音楽とサウンドエフェクトの両方をカバーしています。
  • 出力はMP3またはWAVで提供可能です。

他のモデルを検討すべきケース

  • 出力は記述に基づくインストゥルメンタル音楽とサウンドエフェクトであり、歌唱歌詞や特定の声向けには調整されていません。
  • 歌詞やボーカル曲が必要な場合は、歌に特化した音楽サービスの方が適しています。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    音楽TokenLab エンドポイント
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "duration": 30,
      "output_format": "mp3",
      "model": "stable-audio-3",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

料金

1リクエストあたり
Official
$0.261リクエストあたり
公式価格
$0.261リクエストあたり

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでStable Audio 3.0を開き、プロンプトを編集・送信できます。

stable-audio-3と/v1/music/generationsでmusicを実行。結果、ステータス、コストを表示します。

ユースケース

  • サウンドトラックのベース音

    ビデオ、ゲームメニュー、製品デモの背景に流す指定の長さのBGMを生成し、エディターでトリミングやループを行うことができます。

  • インストゥルメンタルのスケッチ

    作曲家に依頼したり、プロジェクト用にライセンス曲を選んだりする前に、ジャンル、テンポ、ムードのアイデアを素早く安価に試すことができます。

  • サウンドエフェクト

    短いテキスト記述からシーンやインターフェース用の衝撃音、アンビエンス、フォーリーを作成し、必要なキューに合わせた長さを選択できます。

  • プロトタイプオーディオ

    サウンドデザイナーによる最終的なオーディオが制作される前に、レビュー担当者がペースや感触を判断できるよう、アプリやゲームのデモにプレースホルダー音を埋め込むことができます。

プロンプト例

落ち着いたローファイ・ヒップホップ、柔らかなピアノとレコードのノイズ、90 BPM、45秒。

ブラスの盛り上がりを伴う壮大なオーケストラ風トレーラー、30秒で急停止。

トタン屋根を叩く雨音と遠くの雷鳴、15秒。

FAQ

Stable Audio 3.0とは何ですか?

音楽とサウンドエフェクトのためのStability AIのテキスト・トゥ・オーディオモデルファミリーです。出力は可変長のため長さを選択でき、大規模なスタジオ向けモデルからモバイル端末向けに構築された小型モデルまで、幅広いサイズを取り揃えています。

Stable Audio 3にはどのようなサイズがありますか?

Stabilityのページには、エンタープライズ音響制作向けのLarge、オープンな重みを持つフル楽曲制作向けのMedium、モバイル端末での生成向けのSmallおよびSmall SFXが記載されています。Smallチェックポイントは個別のモデルとしても提供されています。

どのような形式で出力されますか?

MP3とWAVです。MP3はプレビューやウェブ利用に適したコンパクトなファイルを提供し、WAVはデジタルオーディオワークステーションやビデオタイムラインでの編集に適した非圧縮オーディオを保持します。

オーディオの長さを設定できますか?

はい。可変長生成はこのファミリーの明示的な機能であるため、固定されたクリップを後からカットするのではなく、必要な長さを指定できます。作成中のキュー、シーン、またはループに合わせて調整してください。

Stable Audio 3.0は歌詞を歌いますか?

Stabilityは、このファミリーをテキストから音楽やサウンドエフェクトを生成するものとして説明しており、歌詞主導の楽曲向けではありません。言葉を伴う歌唱が必要な場合は、Sunoのような専用の楽曲生成モデルを選択してください。

Stable Audio 3.0 の料金はいくらですか?

TokenLab では Stable Audio 3.0 は $0.26 1リクエストあたり です。詳細は上の料金表を参照してください。

Stable Audio 3.0 はどのエンドポイントを使うべきですか?

Stable Audio 3.0 のデフォルトは https://api.tokenlab.sh/v1/music/generations です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Stable Audio 3.0 はどの操作に対応していますか?

Stable Audio 3.0 は 音楽 に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Stable Audio 3.0 を比較する

ソース

2026/10/02 時点での評価

Stable Audio の他のモデル

関連モデル