各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。 新機能を見る

xAI: grok-stt

Grok STTは、アップロードされた録音データのためのxAIの音声認識(Speech-to-Text)サービスです。この統合機能は、報告された音声期間を伴うバッチ文字起こしを提供します。リアルタイムストリーミングサービスについては、別のインターフェースおよび価格契約が適用されます。
モデルを比較
grok-stt
利用可能xAI音声テキスト変換同期
モダリティ
オーディオ

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    音声からテキストへTokenLab エンドポイント
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="grok-stt" \
      -F language="en"

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

音声からテキストへ

1秒あたり
公式価格
$0.00002778
TokenLab 価格
-
割引
-

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間

データはまだありません

モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでGrok STTを開き、プロンプトを編集・送信できます。

grok-sttと/v1/audio/transcriptionsで音声をテスト。結果とコストを表示します。

ユースケース

01

文字起こし

ミーティング、サポートコール、クリップを構造化テキストにします。

02

横並び比較

応答品質、レイテンシ、価格を並べて比較します。

プロンプト例

短い顧客通話を文字起こしし、アクションアイテムを抜き出してください。

最小限のリクエストを送信し、結果とコストを表示してください。

このモデルと同カテゴリの安いモデルを比較し、それぞれどんなときに選ぶべきか教えてください。

FAQ

Grok STT の料金はいくらですか?

TokenLab では Grok STT は — 1秒あたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Grok STT は何に向いていますか?

Grok STTは音声テキスト変換に対応しています。Createで直接開いて試せます。

Grok STT API はどう呼び出しますか?

Create で Grok STT を開くと、/v1/audio/transcriptions 用のサンプルを試せます。

Grok STT はどのエンドポイントを使うべきですか?

Grok STT のデフォルトは https://api.tokenlab.sh/v1/audio/transcriptions です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

統合する前に Grok STT を試せますか?

Console で Grok STT を開くと、下書きがすぐ準備できて、サインイン後もプロンプトが残ります。

Grok STT はどの操作に対応していますか?

Grok STT は 音声からテキストへ に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Grok の他のモデル

関連モデル