オーディオモデル

音声、音楽、オーディオ処理のためのAIモデル

17 モデル5 社の開発元データ反映日: 2026/09/16

オーディオ · xAI

grok-voice-latest
利用可能
TokenLab 価格/ 公式価格
$0.001333/秒
grok-voice-stt
利用可能
音声テキスト変換
TokenLab 価格/ 公式価格
$0.00002778/秒
grok-voice-think-fast-2.0
利用可能
TokenLab 価格/ 公式価格
$0.001333/秒
grok-voice-tts
利用可能
テキスト読み上げ
TokenLab 価格/ 公式価格
入力$15.00
出力$0.00
/文字

すべてのモデルシリーズ

1 シリーズ

最適な オーディオモデル を選ぶ

タスクへの適合性、出力品質、レイテンシ、価格のバランスが重要です。

選定シグナル

  • 必要な入出力に合わせてモデルを選択。
  • 同一の課金単位でモデルを比較。
  • カタログでは見えない品質とレイテンシを、テストで確認。

FAQ

最適な オーディオモデル とは?

タスク、品質基準、レイテンシ、予算に合致することが重要です。少数の評価セットを用意すると、品質や信頼性の違いを把握しやすくなります。

後からモデルを変更できますか?

はい。モデルIDとリクエスト形式を統一すれば、同じタスクで代替モデルを比較できます。