- 輸入 / 輸出
- $0.30 / $1.20
- 上下文
- 1M
- 最大輸出長度
- 512K
- 模態
- 對話
- 能力
- 工具使用提示詞快取
關於 MiniMax-M3
MiniMax-M3 是 MiniMax 於 2026 年 6 月發布的開放權重模型,專為程式設計、代理任務(agentic work)及長文本任務而設計。它採用 MiniMax 稀疏注意力機制(Sparse Attention)以降低處理超長輸入的成本,並具備回答前推理、工具調用及提示詞快取功能。這是該公司 M 系列的前沿模型,也是 M2.7 的後繼版本。
適用場景
- 與上一代相比,MiniMax 稀疏注意力機制降低了處理超長輸入時的單個 Token 計算量。
- 針對代理任務的自主任務拆解、工具調用及多步驟推理進行了優化。
- 開放權重由 MiniMax 發布,因此可以透過自託管副本來驗證模型行為。
- 推理、工具使用及提示詞快取功能均可在長代理循環中啟用。
其他選擇建議
- 僅支援文字輸入,因此無法直接讀取圖表和螢幕截圖。
- 由於具備推理能力且支援超長輸入,請求處理速度比高速的 M2.x 模型慢。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m3", "input": "Hello!" }'
定價
Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。
輸入 權杖 <= 512K
每 1M Token- Official 價格
- 輸入 $0.30 / 輸出 $1.20 / 快取讀取 $0.06
- Verified 價格
- —
- 折扣
- —
輸入 權杖 > 512K
每 1M Token- Official 價格
- 輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.12
- Verified 價格
- —
- 折扣
- —
快取讀取
- Official 價格
- $0.06
- Verified 價格
- —
- 折扣
- —
| Official 價格每 1M Token | Verified 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 輸入 權杖 <= 512K | 輸入 $0.30 / 輸出 $1.20 / 快取讀取 $0.06 | — | — |
| 輸入 權杖 > 512K | 輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.12 | — | — |
| Prompt 快取價格 | |||
| 快取讀取 | $0.06 | — | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 100.0%
- 近 30 日請求數
- 100+
- 最後活動時間
- 前天
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 MiniMax-M3,並準備好編輯或發送提示詞。
協助我使用 minimax-m3 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
全儲存庫作業
載入大型程式碼庫,讓模型在編輯前追蹤跨模組的變更。
規劃代理
為代理提供一組工具和目標,讓它逐步拆解任務並調用工具。
長文件分析
一次性審閱冗長的轉錄稿、規格書或文件,無需進行分段處理。
提示詞範例
這是完整的儲存庫。重試邏輯是在哪裡實現的?如果我更改其退避(backoff)機制,會導致什麼問題?
這是事件時間軸和服務日誌。請寫出重現該錯誤的步驟,並指出可能出錯的模組名稱。
規劃如何將此單體架構拆分為三個服務,並為每個服務命名您將進行的第一個工具調用。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
MiniMax-M3 與 M2.7 有何不同?
MiniMax 將 M3 定位為圍繞稀疏注意力機制構建的新一代模型,專注於程式設計和代理任務,而 M2.7 則針對早期的代理框架。
MiniMax-M3 是開放權重的嗎?
MiniMax 將 M3 作為開放權重模型發布,因此如果您的數據規範有要求,您可以進行自託管。在執行前,請先閱讀模型卡上的授權條款。
它接受圖像和影片嗎?
不接受。MiniMax-M3 僅接受文字輸入,因此當您需要直接讀取螢幕截圖、圖表、示意圖或影片幀時,請使用支援圖像輸入的模型。
它可以使用工具嗎?
可以。它具備工具調用能力,MiniMax 將其定位於代理規劃,即將任務拆解為多個步驟,並在每一步調用工具。請在請求中傳入您的工具定義,並讓模型決定何時調用它們。
我應該何時使用 M3 而非高速的 M2.x 模型?
若需處理超長輸入或更複雜的代理規劃,請選擇 M3。若單次請求的延遲比推理深度更重要,請選擇高速的 M2.x 變體。
MiniMax-M3 的費用是多少?
在 TokenLab 上,MiniMax-M3 價格為 輸入 $0.30 / 輸出 $1.20 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
MiniMax-M3 的上下文長度與輸出限制為何?
MiniMax-M3 支援最高 1,048,576 tokens 的上下文,單次回應上限為 524,288 tokens。
MiniMax-M3 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 MiniMax-M3 的呼叫。下方的請求範例展示了對應的程式碼格式。
MiniMax-M3 支援哪些操作?
MiniMax-M3 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 MiniMax-M3
來源
更新於 2026年10月2日