各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

MiniMax: MiniMax-M2.5-highspeed

低遅延のコーディングおよびエージェントワークフローのための高速MiniMaxモデル。
モデルを比較
minimax-m2.5-highspeed
利用可能MiniMaxチャット
入力 / 出力
$0.60 / $2.40
コンテキスト
205K
最大出力
64K
モダリティ
チャット
機能
ツール利用プロンプトキャッシュ

MiniMax-M2.5-highspeed について

MiniMax-M2.5-highspeedは、プログラミング、ツール呼び出し、検索、オフィス生産性向上向けに調整された2026年2月モデル「MiniMax-M2.5」の高速サービングオプションです。MiniMaxによると、M2.5とそのhighspeed版は同一の結果を出力しますが、highspeed版の方が高速に動作します。推論、ツール呼び出し、プロンプトキャッシュに対応しており、低遅延のコーディングやエージェントワークフローを目的としています。

得意なこと

  • MiniMaxは、highspeed版がM2.5と同等の結果を出しつつ、より高速に生成を行うとしています。
  • M2.5は、コーディング、ツール呼び出し、検索、およびオフィスでの生産性向上業務を対象としています。
  • 推論、ツール利用、プロンプトキャッシュのすべてが利用可能です。
  • M2.5の重みは公開されているため、自己ホスト環境で動作を確認できます。

他のモデルを検討すべきケース

  • テキスト入力専用であるため、図や写真は言葉で説明する必要があります。
  • M2.1とは異なり、レスポンススキーマモードはありません。構造化出力は、プロンプトとコード内でのバリデーションに依存します。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストResponses API
    POST/v1/responses
    API形式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

料金

Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。

デフォルト仕様

100万トークンあたり
Official 価格
入力 $0.60 / 出力 $2.40 / キャッシュ読み取り $0.03 / キャッシュ書き込み $0.375
Verified 価格
—
割引
—
プロンプトキャッシュ料金

キャッシュ読み取り

Official 価格
$0.03
Verified 価格
—
割引
—

キャッシュ書き込み

Official 価格
$0.375
Verified 価格
—
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでMiniMax-M2.5-highspeedを開き、プロンプトを編集・送信できます。

minimax-m2.5-highspeedと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

  • 低遅延コーディングエージェント

    エージェントがファイルの読み込み、コマンドの実行、計画の修正を行う間、応答性を維持します。

  • 検索およびツールパイプライン

    各モデルステップが検索結果を待機するような、Webツールやデータベースツールの連鎖。

  • オフィス業務の自動化

    スプレッドシート、レポート、スライドのテキストなど、迅速な反復が必要なドラフト作成や修正。

プロンプト例

リポジトリを検索して非推奨クライアントの使用箇所をすべて特定し、ファイルリストを作成した上で、最も単純なものから修正してください。

今四半期のチケットをテーマ別に要約し、週次アップデート用の箇条書きを3つ作成してください。

リスト内の各SKUについてlookup_priceを呼び出し、変更があったものを報告してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

M2.5-highspeedとM2.5の違いは何ですか?

MiniMaxは両者の能力は同一で、速度のみが異なると説明しています。対話型ループやエージェントにおいてステップ間の遅延が重要な場合は、highspeed版を使用してください。

M2.5は何のために構築されましたか?

MiniMaxのリリースノートによると、プログラミング、ツール呼び出し、検索、オフィス生産性において優れた結果を達成しました。これはコーディング専用ではなく、汎用的なエージェントモデルです。

構造化JSONスキーマ出力はサポートされていますか?

このモデルではレスポンススキーマは提供されていませんが、ツール利用はサポートされています。厳密に型定義された出力が必要な場合は、コード内でバリデーションを行うか、スキーマ出力に対応したM2.1を使用してください。

オープンソースですか?

M2.5の重みはHugging FaceのMiniMaxAIで公開されています。「highspeed」という名称はモデルの提供方法と応答速度を指すものであり、別のモデルを指すものではありません。

M2.5-highspeedとM2.7-highspeedのどちらを使うべきですか?

スキルや動的ツール検索などの新しいエージェント機能が必要な場合は、M2.7-highspeedを試してください。プロンプトがM2.5-highspeedに最適化されており、結果が安定している場合は、そのままM2.5-highspeedを維持してください。

MiniMax-M2.5-highspeed の料金はいくらですか?

TokenLab では MiniMax-M2.5-highspeed は 入力 $0.60 / 出力 $2.40 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

MiniMax-M2.5-highspeed のコンテキストウィンドウと出力制限は?

MiniMax-M2.5-highspeed は最大 204,800 トークンのコンテキストに対応し、1回のレスポンスで最大 65,536 トークンまで出力可能です。

MiniMax-M2.5-highspeed はどのエンドポイントを使うべきですか?

MiniMax-M2.5-highspeed のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

MiniMax-M2.5-highspeed はどの操作に対応していますか?

MiniMax-M2.5-highspeed は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

MiniMax-M2.5-highspeed を比較する

ソース

2026/10/02 時点での評価

MiniMax の他のモデル

関連モデル