各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Alibaba: Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15は、オーディオファイルの文字起こし用の日付付き音声認識リリースです。このバージョンを固定することは、文字起こしパイプラインにおいて、繰り返し処理を実行する際に一貫したモデル選択が必要な場合に役立ちます。
モデルを比較
fun-asr-flash-2026-06-15
利用可能Alibaba音声テキスト変換同期
価格
価格 $0.000035
モダリティ
オーディオ

Fun-ASR Flash 2026-06-15 について

Fun-ASR Flash 2026-06-15は、AlibabaのFlash音声認識モデルの特定日付版であり、AlibabaからはQwen-Audio-3.0-ASR-Flashとして提供されています。同期HTTP呼び出しを通じて短い音声ファイルを文字起こしし、先行する会話のやり取りをコンテキストとして認識のバイアス調整に利用します。日付付きIDを指定することで、更新される可能性のある日付なしのエイリアスとは異なり、パイプラインを特定のバージョンに固定できます。

得意なこと

  • 音声とともに以前の会話のやり取りを受け入れるため、進行中の議論から得られる語彙が認識を誘導します。
  • Alibabaは、単語レベルのタイムスタンプと文の境界を同じ同期レスポンス内に記載しています。
  • ID内の日付は特定のリリースを固定するものであり、これにより繰り返し実行される処理の比較可能性が保たれます。

他のモデルを検討すべきケース

  • クリップは約5分間に制限されているため、長い録音には非同期のFun-ASRまたはfiletransモデルが必要です。
  • 完了したクリップのみを処理します。ライブキャプションやディクテーションには、ストリーミングモデルであるFun-ASR Realtimeを使用します。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    音声からテキストへTokenLab エンドポイント
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr-flash-2026-06-15" \
      -F language="en"

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

音声からテキストへ

1秒あたり
公式価格
$0.000035
Official
$0.000035
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでFun-ASR Flash 2026-06-15を開き、プロンプトを編集・送信できます。

fun-asr-flash-2026-06-15と/v1/audio/transcriptionsで音声をテスト。結果とコストを表示します。

ユースケース

  • ボイスメモ

    非同期ジョブをキューに入れることなく、短い録音メモやメッセージを1回のリクエストで文字起こしします。

  • 医療用ディクテーション

    先行する対話をコンテキストとして渡すことで、薬剤名や臨床用語が認識されやすくなります。

  • 固定されたテストパイプライン

    下流の要約処理の変更を同じ文字起こし結果に対して比較する際、バージョンを一定に保ちます。

プロンプト例

この3分間の診療録音を文字起こししてください。コンテキスト:前のやり取りでメトホルミンの投与量について議論しました。

このフィールドエンジニアのPLC故障に関するボイスメモを文字起こしし、単語ごとのタイムスタンプを返してください。

この短い顧客通話クリップを、以前のチャットのやり取りをコンテキストとして使用して文字起こししてください。

FAQ

fun-asr-flash-2026-06-15の日付は何を意味しますか?

これは2026年6月15日の特定のリリースを識別するものです。日付付きIDを呼び出すことで、パイプラインをそのリリースに固定できます。AlibabaはこれをQwen-Audio-3.0-ASR-Flashという名称で提供しています。

音声クリップの長さはどれくらいまで可能ですか?

Alibabaのドキュメントでは、1呼び出しあたり約5分、最大2GBのファイルという制限が記載されています。より長い録音には、非同期ファイルジョブを受け付けるFun-ASRまたはQwen3 ASR Flash Filetransを使用してください。

会話に関するコンテキストを与えることはできますか?

はい。チャット形式のメッセージフォーマットを使用しているため、音声の前に以前のやり取りを渡すことができます。モデルはそれらを使用してトピックに適合する語彙を優先するため、専門用語の認識に役立ちます。

タイムスタンプは返されますか?

はい。Alibabaはレスポンス内に単語レベルのタイムスタンプと文の境界を記載しているため、別の調整ステップなしで字幕、レビュー、または検索のためにテキストを音声に合わせることができます。

Fun-ASR Flash 2026-06-15 の料金はいくらですか?

TokenLab では Fun-ASR Flash 2026-06-15 は $0.000035 1秒あたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Fun-ASR Flash 2026-06-15 はどのエンドポイントを使うべきですか?

Fun-ASR Flash 2026-06-15 のデフォルトは https://api.tokenlab.sh/v1/audio/transcriptions です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Fun-ASR Flash 2026-06-15 はどの操作に対応していますか?

Fun-ASR Flash 2026-06-15 は 音声からテキストへ に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Fun-ASR Flash 2026-06-15 を比較する

ソース

2026/10/02 時点での評価

Fun-ASR の他のモデル

関連モデル