各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Alibaba: Qwen Flash

Qwen Flashは、大きなコンテキストウィンドウを備え、日常的なテキストタスクを処理します。大量の要約、コンテンツ変換、および会話の中で長いソース資料を保持し続ける必要があるアシスタントに適した候補です。
モデルを比較
qwen-flash
利用可能Alibabaチャット
入力 / 出力
$0.05 / $0.40
コンテキスト
998K
最大出力
32K
モダリティ
チャット
機能
プロンプトキャッシュ推論

Qwen Flash について

Qwen Flashは、AlibabaのQwenシリーズにおける高速かつ低コストな汎用テキストモデルで、要約、書き換え、シンプルなアシスタントなどの大量処理を目的としています。能力的にはQwen PlusやQwen Maxの下位に位置し、深さよりも処理量が重要な場合に最初に試すべきモデルです。Alibabaは本モデルをレガシーなQwen名称としてリストアップしており、新規プロジェクトには新しいQwen3世代を推奨しています。

得意なこと

  • 大量のテキストをリクエストごとに低遅延で要約および再フォーマットすること。
  • 長いソースドキュメントを会話中に保持し、要約や回答を行うこと。
  • オプションの思考モードにより、必要なリクエストに対してのみ推論能力を使用できます。
  • プロンプトキャッシングにより、長いシステムプロンプトやドキュメントが再利用される際の重複作業を削減します。

他のモデルを検討すべきケース

  • テキスト入力のみで、ツール呼び出しには対応していません。
  • 推論の深さや文章の品質は、高度な分析タスクにおいてQwen PlusやQwen Maxに及びません。
  • Alibabaは本モデルをレガシー名称として扱っているため、新規構築には現在のQwen3モデルの方が適している可能性があります。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストResponses API
    POST/v1/responses
    API形式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "qwen-flash",
        "input": "Hello!"
      }'

料金

Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。

入力 トークン <= 125K

100万トークンあたり
Official 価格
入力 $0.05 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.0625 / テキスト 入力 $0.05 / テキスト 出力 $0.40
Verified 価格
—
割引
—

入力 トークン <= 250K

100万トークンあたり
Official 価格
入力 $0.05 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.0625 / テキスト 入力 $0.05 / テキスト 出力 $0.40
Verified 価格
—
割引
—

入力 トークン <= 1M

100万トークンあたり
Official 価格
入力 $0.25 / 出力 $2.00 / キャッシュ読み取り $0.05 / キャッシュ書き込み $0.3125 / テキスト 入力 $0.25 / テキスト 出力 $2.00
Verified 価格
—
割引
—
プロンプトキャッシュ料金

キャッシュ読み取り

Official 価格
$0.01
Verified 価格
—
割引
—

キャッシュ書き込み

Official 価格
$0.0625
Verified 価格
—
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでQwen Flashを開き、プロンプトを編集・送信できます。

qwen-flashと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

向いている用途
  • 推論
  • 一括要約

    何千もの記事、通話記録、レビューを短い要約に凝縮します。すべての項目に同じプロンプトを適用可能です。

  • コンテンツ変換

    メモを洗練されたメールに変換したり、表を文章にするなど、テキストのトーン、言語、形式を変換します。

  • 軽量なチャットアシスタント

    回答が短く、ニュアンスよりも応答速度が重視されるFAQボットやアプリ内ヘルパーのバックエンドとして機能します。

  • 長文ドキュメントのQ&A

    長いマニュアルやポリシー集をプロンプトに貼り付け、それに基づいてスタッフの質問に直接回答します。

プロンプト例

以下の製品説明をフレンドリーなトーンで60語以内で書き直してください。モデル番号は変更しないでください。

この会議の議事録を、決定事項、担当者付きのアクションアイテム、未解決の質問に要約してください。

上記のポリシーテキストのみを使用して回答してください:契約者は旅費を請求できますか?使用した条項を引用してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Qwen Flashは何に最適ですか?

要約、書き換え、翻訳形式の変換、シンプルなアシスタントといった、大量の日常的なテキストタスクに最適です。Qwenシリーズの中で高速かつ安価な層であるため、スループットが重要で、タスクに深い推論が必要ない場合に使用してください。

Qwen FlashとQwen Plusの違いは何ですか?

Flashは速度重視の層であり、Plusはバランス型です。Plusはより強力な分析と文章作成能力を提供し、Flashは単純な作業をより速く安価に完了させます。まずはFlashで開始し、回答が不十分な場合に特定のタスクをPlusに移行してください。

Qwen Flashは思考モードをサポートしていますか?

はい。ステップバイステップの推論が必要なリクエストには思考モードをオンにし、単純なリクエストにはオフにすることができます。Alibabaのドキュメントでは、このモデルで思考モードがサポートされていると記載されています。

Qwen Flashは画像を読み込んだりツールを呼び出したりできますか?

いいえ。画像入力やツール呼び出し機能のない、テキスト入力・テキスト出力モデルです。リクエストにそれらが必要な場合は、Qwenのビジョンモデルや他のファミリーを選択してください。

Qwen Flashは新規プロジェクトに適した選択肢ですか?

既存のパイプラインはそのまま維持できますし、安定した大量処理ジョブには引き続き使用可能です。新規構築の場合は、Alibabaは新しいQwen3世代を推奨しているため、まずはQwen3.8 Flashと比較検討してください。

Qwen Flash の料金はいくらですか?

TokenLab では Qwen Flash は 入力 $0.05 / 出力 $0.40 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Qwen Flash のコンテキストウィンドウと出力制限は?

Qwen Flash は最大 997,952 トークンのコンテキストに対応し、1回のレスポンスで最大 32,768 トークンまで出力可能です。

Qwen Flash はどのエンドポイントを使うべきですか?

Qwen Flash のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Qwen Flash はどの操作に対応していますか?

Qwen Flash は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Qwen Flash を比較する

ソース

2026/10/02 時点での評価

Qwen の他のモデル

関連モデル