MiniMax: MiniMax-M3
minimax-m3- 入力 / 出力
- $0.30 / $1.20
- コンテキスト
- 1M
- 最大出力
- 512K
- モダリティ
- チャット
- 機能
- ツール利用プロンプトキャッシュ
MiniMax-M3 について
MiniMax-M3は、コーディング、エージェント作業、長文コンテキストタスク向けに2026年6月に公開されたMiniMaxのオープンウェイトモデルです。MiniMax Sparse Attentionを採用することで非常に長い入力のコストを抑え、回答前の推論、ツール呼び出し、プロンプトキャッシュが可能です。同社のフロンティアMシリーズモデルであり、M2.7の後継にあたります。
得意なこと
- MiniMax Sparse Attentionにより、非常に長い入力におけるトークンあたりの計算量が前世代と比較して削減されています。
- エージェントによる自律的なタスク分解、ツール呼び出し、多段階推論をターゲットとしています。
- MiniMaxによってオープンウェイトが公開されているため、セルフホスト環境で動作を確認できます。
- 長時間のエージェントループにおいて、推論、ツール使用、プロンプトキャッシュをすべて有効にできます。
他のモデルを検討すべきケース
- テキスト入力専用のため、チャートやスクリーンショットを直接読み取ることはできません。
- 推論と非常に長い入力を行うため、高速なM2.xモデルよりもリクエストの処理に時間がかかります。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストResponses APIPOST/v1/responsesAPI形式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m3", "input": "Hello!" }'
料金
Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。
入力 トークン <= 512K
100万トークンあたり- Official 価格
- 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.06
- Verified 価格
- —
- 割引
- —
入力 トークン > 512K
100万トークンあたり- Official 価格
- 入力 $0.60 / 出力 $2.40 / キャッシュ読み取り $0.12
- Verified 価格
- —
- 割引
- —
キャッシュ読み取り
- Official 価格
- $0.06
- Verified 価格
- —
- 割引
- —
| Official 価格100万トークンあたり | Verified 価格100万トークンあたり | 割引 | |
|---|---|---|---|
| 入力 トークン <= 512K | 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.06 | — | — |
| 入力 トークン > 512K | 入力 $0.60 / 出力 $2.40 / キャッシュ読み取り $0.12 | — | — |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.06 | — | — |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
- 30日間の成功率
- 100.0%
- 30日間のリクエスト数
- 100+
- 最終利用
- 3 日前
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでMiniMax-M3を開き、プロンプトを編集・送信できます。
minimax-m3と/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
リポジトリ全体の作業
大規模なコードベースを読み込み、編集前にモデルがモジュールをまたいだ変更を追跡できるようにします。
プランニングエージェント
エージェントにツールセットと目標を与え、タスクを分解して段階的にツールを呼び出させます。
長文ドキュメントの分析
長いトランスクリプト、仕様書、報告書などを、分割することなく一度にレビューします。
プロンプト例
リポジトリ全体を提示します。リトライロジックはどこに実装されていますか?また、バックオフを変更すると何が壊れますか?
インシデントのタイムラインとサービスログを提示します。バグを再現する手順を作成し、障害の原因と思われるモジュールを特定してください。
このモノリスを3つのサービスに分割する計画を立て、それぞれに対して最初に行うべきツール呼び出しを提示してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
MiniMax-M3とM2.7の違いは何ですか?
MiniMaxはM3を、非常に長いコンテキストのためのスパースアテンションを中心に構築され、コーディングやエージェントタスクを目的とした新世代モデルとして位置づけています。一方、M2.7は初期のエージェントハーネスをターゲットとしています。
MiniMax-M3はオープンウェイトですか?
MiniMaxはM3をオープンウェイトモデルとして公開しているため、データ規制等の要件がある場合はセルフホストが可能です。実行前にモデルカードのライセンスを確認してください。
画像や動画は入力できますか?
いいえ。MiniMax-M3はテキスト入力専用です。スクリーンショット、チャート、図表、動画フレームを直接読み取る必要がある場合は、画像入力に対応したモデルを使用してください。
ツールは使用できますか?
はい。ツール呼び出しが可能で、MiniMaxはエージェントのプランニング(タスクをステップに分解し、各ステップでツールを呼び出す)を想定しています。リクエストにツール定義を含めることで、モデルが呼び出しのタイミングを判断します。
高速なM2.xモデルではなくM3を使うべきなのはどのような時ですか?
非常に長い入力や、より高度なエージェントプランニングが必要な場合はM3を選択してください。推論の深さよりも各ターンの応答速度が重要な場合は、高速なM2.xバリアントを選択してください。
MiniMax-M3 の料金はいくらですか?
TokenLab では MiniMax-M3 は 入力 $0.30 / 出力 $1.20 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
MiniMax-M3 のコンテキストウィンドウと出力制限は?
MiniMax-M3 は最大 1,048,576 トークンのコンテキストに対応し、1回のレスポンスで最大 524,288 トークンまで出力可能です。
MiniMax-M3 はどのエンドポイントを使うべきですか?
MiniMax-M3 のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
MiniMax-M3 はどの操作に対応していますか?
MiniMax-M3 は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
MiniMax-M3 を比較する
ソース
2026/10/02 時点での評価