為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

MiniMax: MiniMax-M2.5-highspeed

用於低延遲程式編寫與代理工作流程的高速 MiniMax 模型。
比較模型
minimax-m2.5-highspeed
可用MiniMax對話
輸入 / 輸出
$0.60 / $2.40
上下文
205K
最大輸出長度
64K
模態
對話
能力
工具使用提示詞快取

關於 MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed 是 MiniMax-M2.5 的快速服務版本,這款 2026 年 2 月發布的模型專為程式設計、工具呼叫、搜尋及辦公生產力而調校。MiniMax 表示 M2.5 及其 highspeed 版本提供相同的結果,但 highspeed 版本執行速度更快。它具備推理、呼叫工具及提示詞快取(prompt caching)功能,旨在實現低延遲的程式設計與代理(agent)工作流程。

適用場景

  • MiniMax 表示 highspeed 版本在生成速度更快的同時,能達到與 M2.5 相同的結果。
  • M2.5 的目標應用包括程式設計、工具呼叫、搜尋以及辦公生產力工作。
  • 支援推理、工具使用及提示詞快取功能。
  • M2.5 的權重已公開發布,因此可以透過自託管副本來驗證其行為。

其他選擇建議

  • 僅支援文字輸入,因此圖表和照片必須以文字描述。
  • 與 M2.1 不同,此模型沒有回應結構模式(response-schema mode);結構化輸出需依賴程式碼中的提示詞與驗證。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

預設規格

每 1M Token
Official 價格
輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.03 / 快取寫入 $0.375
Verified 價格
—
折扣
—
Prompt 快取價格

快取讀取

Official 價格
$0.03
Verified 價格
—
折扣
—

快取寫入

Official 價格
$0.375
Verified 價格
—
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 MiniMax-M2.5-highspeed,並準備好編輯或發送提示詞。

協助我使用 minimax-m2.5-highspeed 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

  • 低延遲程式設計代理

    在代理讀取檔案、執行指令及修改計畫時,保持其回應速度。

  • 搜尋與工具管線

    串聯網頁或資料庫工具,讓每個模型步驟等待檢索結果。

  • 辦公任務自動化

    草擬並修改試算表、報告或簡報文字,適用於需要多次快速迭代的場景。

提示詞範例

搜尋儲存庫中所有已棄用客戶端的使用情況,列出檔案並修補最簡單的項目。

按主題總結本季度的工單,然後為每週更新草擬三個要點。

為清單中的每個 SKU 呼叫 lookup_price,並報告任何變更。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

M2.5-highspeed 與 M2.5 有何不同?

MiniMax 將兩者描述為功能相同,僅在速度上有所差異。當互動迴圈或代理中的步驟間延遲至關重要時,請使用 highspeed 版本。

M2.5 的設計用途為何?

MiniMax 的發布說明指出,它在程式設計、工具呼叫、搜尋及辦公生產力方面達到了領先的結果。它是一款通用代理模型,而非僅限於程式設計的模型。

它支援結構化 JSON 架構輸出嗎?

此模型不提供回應架構,但支援工具使用。如果您需要嚴格類型的輸出,請在程式碼中進行驗證,或使用具備架構輸出的 M2.1。

它是開源的嗎?

M2.5 的權重已在 Hugging Face 的 MiniMaxAI 下發布。highspeed 名稱是指模型的服務方式及其回答速度,並非指不同的模型。

我應該使用 M2.5-highspeed 還是 M2.7-highspeed?

若需要技能(skills)和動態工具搜尋等較新的代理功能,請嘗試 M2.7-highspeed。如果您的提示詞已針對 M2.5-highspeed 進行調校且結果穩定,則建議保留使用 M2.5-highspeed。

MiniMax-M2.5-highspeed 的費用是多少?

在 TokenLab 上,MiniMax-M2.5-highspeed 價格為 輸入 $0.60 / 輸出 $2.40 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

MiniMax-M2.5-highspeed 的上下文長度與輸出限制為何?

MiniMax-M2.5-highspeed 支援最高 204,800 tokens 的上下文,單次回應上限為 65,536 tokens。

MiniMax-M2.5-highspeed 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 MiniMax-M2.5-highspeed 的呼叫。下方的請求範例展示了對應的程式碼格式。

MiniMax-M2.5-highspeed 支援哪些操作?

MiniMax-M2.5-highspeed 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 MiniMax-M2.5-highspeed

來源

更新於 2026年10月2日

更多來自 MiniMax 的模型

相關模型