為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

MiniMax: MiniMax-M3

用於長上下文程式編寫、感知與代理規劃的 MiniMax 多模態模型。
比較模型
minimax-m3
可用MiniMax對話
輸入 / 輸出
$0.30 / $1.20
上下文
1M
最大輸出長度
512K
模態
對話
能力
工具使用提示詞快取

關於 MiniMax-M3

MiniMax-M3 是 MiniMax 於 2026 年 6 月發布的開放權重模型,專為程式設計、代理任務(agentic work)及長文本任務而設計。它採用 MiniMax 稀疏注意力機制(Sparse Attention)以降低處理超長輸入的成本,並具備回答前推理、工具調用及提示詞快取功能。這是該公司 M 系列的前沿模型,也是 M2.7 的後繼版本。

適用場景

  • 與上一代相比,MiniMax 稀疏注意力機制降低了處理超長輸入時的單個 Token 計算量。
  • 針對代理任務的自主任務拆解、工具調用及多步驟推理進行了優化。
  • 開放權重由 MiniMax 發布,因此可以透過自託管副本來驗證模型行為。
  • 推理、工具使用及提示詞快取功能均可在長代理循環中啟用。

其他選擇建議

  • 僅支援文字輸入,因此無法直接讀取圖表和螢幕截圖。
  • 由於具備推理能力且支援超長輸入,請求處理速度比高速的 M2.x 模型慢。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m3",
        "input": "Hello!"
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

輸入 權杖 <= 512K

每 1M Token
Official 價格
輸入 $0.30 / 輸出 $1.20 / 快取讀取 $0.06
Verified 價格
—
折扣
—

輸入 權杖 > 512K

每 1M Token
Official 價格
輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.12
Verified 價格
—
折扣
—
Prompt 快取價格

快取讀取

Official 價格
$0.06
Verified 價格
—
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
100.0%
近 30 日請求數
100+
最後活動時間
前天

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 MiniMax-M3,並準備好編輯或發送提示詞。

協助我使用 minimax-m3 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

  • 全儲存庫作業

    載入大型程式碼庫,讓模型在編輯前追蹤跨模組的變更。

  • 規劃代理

    為代理提供一組工具和目標,讓它逐步拆解任務並調用工具。

  • 長文件分析

    一次性審閱冗長的轉錄稿、規格書或文件,無需進行分段處理。

提示詞範例

這是完整的儲存庫。重試邏輯是在哪裡實現的?如果我更改其退避(backoff)機制,會導致什麼問題?

這是事件時間軸和服務日誌。請寫出重現該錯誤的步驟,並指出可能出錯的模組名稱。

規劃如何將此單體架構拆分為三個服務,並為每個服務命名您將進行的第一個工具調用。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

MiniMax-M3 與 M2.7 有何不同?

MiniMax 將 M3 定位為圍繞稀疏注意力機制構建的新一代模型,專注於程式設計和代理任務,而 M2.7 則針對早期的代理框架。

MiniMax-M3 是開放權重的嗎?

MiniMax 將 M3 作為開放權重模型發布,因此如果您的數據規範有要求,您可以進行自託管。在執行前,請先閱讀模型卡上的授權條款。

它接受圖像和影片嗎?

不接受。MiniMax-M3 僅接受文字輸入,因此當您需要直接讀取螢幕截圖、圖表、示意圖或影片幀時,請使用支援圖像輸入的模型。

它可以使用工具嗎?

可以。它具備工具調用能力,MiniMax 將其定位於代理規劃,即將任務拆解為多個步驟,並在每一步調用工具。請在請求中傳入您的工具定義,並讓模型決定何時調用它們。

我應該何時使用 M3 而非高速的 M2.x 模型?

若需處理超長輸入或更複雜的代理規劃,請選擇 M3。若單次請求的延遲比推理深度更重要,請選擇高速的 M2.x 變體。

MiniMax-M3 的費用是多少?

在 TokenLab 上,MiniMax-M3 價格為 輸入 $0.30 / 輸出 $1.20 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

MiniMax-M3 的上下文長度與輸出限制為何?

MiniMax-M3 支援最高 1,048,576 tokens 的上下文,單次回應上限為 524,288 tokens。

MiniMax-M3 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 MiniMax-M3 的呼叫。下方的請求範例展示了對應的程式碼格式。

MiniMax-M3 支援哪些操作?

MiniMax-M3 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 MiniMax-M3

來源

更新於 2026年10月2日

更多來自 MiniMax 的模型

相關模型