各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Alibaba: Qwen3.5-Flash

Qwen3.5 Flashは、3.5ラインにおける長文テキスト作業向けの効率重視オプションです。タスク全体を通じて同じ大規模ソースを参照し続ける必要がある要約や、繰り返しのドキュメント処理ステップをサポートできます。
モデルを比較
qwen3.5-flash
利用可能Alibabaチャット
入力 / 出力
$0.10 / $0.40
コンテキスト
992K
最大出力
64K
モダリティ
チャット
機能
プロンプトキャッシュ

Qwen3.5-Flash について

Qwen3.5-Flashは、AlibabaのQwen3.5ファミリーにおける軽量なホスト型モデルであり、Qwen3.5-Plusよりも高速かつ低コストなテキスト処理を実現するために構築されています。非常に大きなコンテキストとプロンプトキャッシングに対応しており、要約や同一の大きなソースに対する繰り返し処理に適しています。また、同ファミリーの広範な言語サポートを継承しています。

得意なこと

  • プロンプトキャッシングは、一つの大きなソースに対する繰り返しの参照に役立ちます。
  • Plusティアよりも速度を重視して調整されています。
  • Qwen3.5ファミリーの201言語対応を継承しています。
  • 要約やタグ付けといったパイプライン処理に適しています。

他のモデルを検討すべきケース

  • Qwen3.5-Plusは、より高度な分析において優れた性能を発揮します。
  • テキスト入力専用であるため、ビジョンモデルの代わりにはなりません。
  • エージェントによるコーディング結果を報告するQwen3.8-Flashよりも古いモデルです。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストResponses API
    POST/v1/responses
    API形式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "qwen3.5-flash",
        "input": "Hello!"
      }'

料金

VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。

入力 トークン <= 125K

100万トークンあたり
公式価格
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
Official
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
割引
—

入力 トークン <= 250K

100万トークンあたり
公式価格
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
Official
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
割引
—

入力 トークン <= 1M

100万トークンあたり
公式価格
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
Official
入力 $0.10 / 出力 $0.40 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 / テキスト 入力 $0.10 / テキスト 出力 $0.40
割引
—
プロンプトキャッシュ料金

キャッシュ読み取り

公式価格
$0.01
Official
$0.01
割引
—

キャッシュ書き込み

公式価格
$0.125
Official
$0.125
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでQwen3.5-Flashを開き、プロンプトを編集・送信できます。

qwen3.5-flashと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

  • バッチ要約

    夜間のパイプラインで長いレポートを要約します。同一の大きなソースをキャッシュすることで、質問対象のセクション全体で活用できます。

  • ドキュメントのタグ付けとルーティング

    長いテキストをトピック、緊急度、または所有者でラベル付けし、後続のコードで解析可能な固定形式で結果を返します。

  • 単一ソースに対する繰り返しのQ&A

    マニュアルやポリシーを一度キャッシュすれば、ターンごとにテキスト全体を再処理するコストをかけずに、それらに対して多くの質問を行うことができます。

  • ドラフトのクリーンアップ

    著者の主張や数値をそのまま維持しつつ、長いドラフトの文法、トーン、構成を修正します。

プロンプト例

このハンドブックの各セクションを2行で要約してください。

このチケットに製品領域と緊急度のタグを付け、JSON形式で返してください。

貼り付けられたポリシーに関する質問に答えてください。記載がない場合は「記載なし」と回答してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Qwen3.5-Flashとは具体的にどのようなモデルですか?

AlibabaのQwen3.5ファミリーにおける軽量なホスト型モデルで、長いテキストの高速処理を目的としています。性能面ではQwen3.5-Plusの下位に位置し、繰り返し発生する定型的なドキュメント処理に適しています。

Qwen3.5-PlusではなくFlashを選択すべきなのはどのような場合ですか?

深さよりも速度やコストが重要な場合(大量の要約、タグ付け、固定ソースに対するQ&Aなど)にはFlashを選択してください。複数の箇所にわたる慎重な分析が必要な回答を求める場合は、Plusに切り替えてください。

Qwen3.5-Flashはプロンプトキャッシングをサポートしていますか?

はい。プロンプトキャッシングは、同一の長いソースが繰り返し送信される場合に役立ちます。呼び出し間で質問のみが変化するような、反復的なドキュメント処理ステップなどで有効です。

Qwen3.5-Flashは画像を読み取れますか?

いいえ。Qwen3.5-Flashはテキスト専用です。スクリーンショット、スキャン画像、グラフなどがタスクに含まれる場合は、Qwen3.8-Flash、Qwen3.7-Plus、またはQwen3-VL Plusを使用し、抽出したテキストをこのモデルに送信してください。

Alibabaからより新しいFlashモデルは出ていますか?

はい。Qwen3.8-Flashは、エージェントによるコーディングや長期的なエージェント作業を目的とした、より新しいマルチモーダルな混合エキスパートモデルです。すでに良好に機能しているプレーンテキストのパイプラインには、引き続きQwen3.5-Flashを使用してください。

Qwen3.5-Flash の料金はいくらですか?

TokenLab では Qwen3.5-Flash は 入力 $0.10 / 出力 $0.40 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Qwen3.5-Flash のコンテキストウィンドウと出力制限は?

Qwen3.5-Flash は最大 991,808 トークンのコンテキストに対応し、1回のレスポンスで最大 65,536 トークンまで出力可能です。

Qwen3.5-Flash はどのエンドポイントを使うべきですか?

Qwen3.5-Flash のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Qwen3.5-Flash はどの操作に対応していますか?

Qwen3.5-Flash は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Qwen3.5-Flash を比較する

ソース

2026/10/02 時点での評価

Qwen 3 / QwQ の他のモデル

関連モデル