MiniMax: MiniMax-M2.1-highspeed
minimax-m2.1-highspeed- 入力 / 出力
- $0.60 / $2.40
- コンテキスト
- 205K
- 最大出力
- 128K
- モダリティ
- チャット
- 機能
- ツール利用プロンプトキャッシュ
MiniMax-M2.1-highspeed について
MiniMax-M2.1-highspeedは、コーディングやツール支援タスク向けにMiniMaxのM2.1モデルを高速化に特化させたバージョンです。アプリケーションが生成された指示、ツールの実行結果、そして次の応答を交互に繰り返すような、インタラクティブなエージェントループに適しています。M2.1の推論能力、ツール利用、JSONモード、スキーマ出力を維持しており、機能を犠牲にすることなく応答速度を向上させています。
得意なこと
- モデルの回答、ツールの実行、モデルの再回答というループを想定しており、各ターンの遅延が積み重なるような用途向けです。
- M2.1のJSONモードおよびスキーマ制約付き出力を維持しています。
- ステップが必要とする場面で推論を利用可能です。
- ツール利用とプロンプトキャッシングの両方をサポートしています。
他のモデルを検討すべきケース
- テキストのみ対応しており、スクリーンショットやその他の画像は送信できません。
- M2.5-highspeedおよびM2.7-highspeedは、より新しい高速バリアントであり、新規ビルドに適している場合があります。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストResponses APIPOST/v1/responsesAPI形式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.1-highspeed", "input": "Hello!" }'
料金
Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。
デフォルト仕様
100万トークンあたり- Official 価格
- 入力 $0.60 / 出力 $2.40 / キャッシュ読み取り $0.03 / キャッシュ書き込み $0.375
- Verified 価格
- —
- 割引
- —
キャッシュ読み取り
- Official 価格
- $0.03
- Verified 価格
- —
- 割引
- —
キャッシュ書き込み
- Official 価格
- $0.375
- Verified 価格
- —
- 割引
- —
| Official 価格100万トークンあたり | Verified 価格100万トークンあたり | 割引 | |
|---|---|---|---|
| デフォルト仕様 | 入力 $0.60 / 出力 $2.40 / キャッシュ読み取り $0.03 / キャッシュ書き込み $0.375 | — | — |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.03 | — | — |
| キャッシュ書き込み | $0.375 | — | — |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでMiniMax-M2.1-highspeedを開き、プロンプトを編集・送信できます。
minimax-m2.1-highspeedと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
インタラクティブなコーディングアシスタント
エディタ内ヘルパーを強化し、ファイルの読み込みや編集を行う際、各指示に対して迅速に応答する必要があります。
多数の短いステップで構成されるエージェントループ
計画の実行、ツールの呼び出し、結果の読み取りというサイクルにおいて、モデルのレイテンシがタスク全体の時間を支配する場合に適しています。
ライブアプリケーションにおける構造化された応答
応答を待機しているフロントエンドに対し、スキーマに準拠したJSONを返します。
プロンプト例
utils/date.tsを開いてタイムゾーンのバグを見つけ、修正してください。その後、テストを実行し、失敗したもののみを報告してください。
これらのツール結果に基づき、次の単一のアクションを決定し、actionとargsフィールドを持つJSONとして出力してください。
リストされたファイル全体で関数名を変更し、それぞれについて差分を表示してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
MiniMax-M2.1の高速版は何ですか?
コーディングやツール支援タスク向けに、速度を重視したオプションとして提供されるM2.1世代のモデルです。インタラクティブなエージェントのステップ間の遅延が重要な場合に選択してください。
M2.1と比較して機能は失われますか?
いいえ。推論、ツール利用、プロンプトキャッシング、JSONモード、応答スキーマといったM2.1の機能セットを維持しているため、変更点はターン速度のみです。実際のタスクでの品質については、ご自身でテストすることをお勧めします。
構造化出力に使用できますか?
はい。JSONモードと応答スキーマの両方がサポートされているため、固定形式での出力を要求し、アプリケーションで解析することが可能です。
より新しい高速なMiniMaxモデルはありますか?
はい。MiniMaxはその後、より高速なオプションとしてM2.5-highspeedおよびM2.7-highspeedをリリースしました。既存の統合を維持するのではなく、新しいプロジェクトを開始する場合は、ご自身のタスクで比較検討してください。
画像はサポートされていますか?
いいえ。画像入力には対応しておらず、テキストの読み書きのみを行います。プロンプトで画像や動画の理解が必要な場合は、MiniMax M3を選択してください。テキストプロンプトとツール結果のみを受け付けます。
MiniMax-M2.1-highspeed の料金はいくらですか?
TokenLab では MiniMax-M2.1-highspeed は 入力 $0.60 / 出力 $2.40 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
MiniMax-M2.1-highspeed のコンテキストウィンドウと出力制限は?
MiniMax-M2.1-highspeed は最大 204,800 トークンのコンテキストに対応し、1回のレスポンスで最大 131,072 トークンまで出力可能です。
MiniMax-M2.1-highspeed はどのエンドポイントを使うべきですか?
MiniMax-M2.1-highspeed のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
MiniMax-M2.1-highspeed はどの操作に対応していますか?
MiniMax-M2.1-highspeed は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
MiniMax-M2.1-highspeed を比較する
ソース
2026/10/02 時点での評価