- 輸入 / 輸出
- $0.60 / $2.40
- 上下文
- 205K
- 最大輸出長度
- 64K
- 模態
- 對話
- 能力
- 工具使用提示詞快取
關於 MiniMax-M2.5-highspeed
MiniMax-M2.5-highspeed 是 MiniMax-M2.5 的快速服務版本,這款 2026 年 2 月發布的模型專為程式設計、工具呼叫、搜尋及辦公生產力而調校。MiniMax 表示 M2.5 及其 highspeed 版本提供相同的結果,但 highspeed 版本執行速度更快。它具備推理、呼叫工具及提示詞快取(prompt caching)功能,旨在實現低延遲的程式設計與代理(agent)工作流程。
適用場景
- MiniMax 表示 highspeed 版本在生成速度更快的同時,能達到與 M2.5 相同的結果。
- M2.5 的目標應用包括程式設計、工具呼叫、搜尋以及辦公生產力工作。
- 支援推理、工具使用及提示詞快取功能。
- M2.5 的權重已公開發布,因此可以透過自託管副本來驗證其行為。
其他選擇建議
- 僅支援文字輸入,因此圖表和照片必須以文字描述。
- 與 M2.1 不同,此模型沒有回應結構模式(response-schema mode);結構化輸出需依賴程式碼中的提示詞與驗證。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
定價
Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。
預設規格
每 1M Token- Official 價格
- 輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.03 / 快取寫入 $0.375
- Verified 價格
- —
- 折扣
- —
快取讀取
- Official 價格
- $0.03
- Verified 價格
- —
- 折扣
- —
快取寫入
- Official 價格
- $0.375
- Verified 價格
- —
- 折扣
- —
| Official 價格每 1M Token | Verified 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $0.60 / 輸出 $2.40 / 快取讀取 $0.03 / 快取寫入 $0.375 | — | — |
| Prompt 快取價格 | |||
| 快取讀取 | $0.03 | — | — |
| 快取寫入 | $0.375 | — | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 MiniMax-M2.5-highspeed,並準備好編輯或發送提示詞。
協助我使用 minimax-m2.5-highspeed 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
低延遲程式設計代理
在代理讀取檔案、執行指令及修改計畫時,保持其回應速度。
搜尋與工具管線
串聯網頁或資料庫工具,讓每個模型步驟等待檢索結果。
辦公任務自動化
草擬並修改試算表、報告或簡報文字,適用於需要多次快速迭代的場景。
提示詞範例
搜尋儲存庫中所有已棄用客戶端的使用情況,列出檔案並修補最簡單的項目。
按主題總結本季度的工單,然後為每週更新草擬三個要點。
為清單中的每個 SKU 呼叫 lookup_price,並報告任何變更。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
M2.5-highspeed 與 M2.5 有何不同?
MiniMax 將兩者描述為功能相同,僅在速度上有所差異。當互動迴圈或代理中的步驟間延遲至關重要時,請使用 highspeed 版本。
M2.5 的設計用途為何?
MiniMax 的發布說明指出,它在程式設計、工具呼叫、搜尋及辦公生產力方面達到了領先的結果。它是一款通用代理模型,而非僅限於程式設計的模型。
它支援結構化 JSON 架構輸出嗎?
此模型不提供回應架構,但支援工具使用。如果您需要嚴格類型的輸出,請在程式碼中進行驗證,或使用具備架構輸出的 M2.1。
它是開源的嗎?
M2.5 的權重已在 Hugging Face 的 MiniMaxAI 下發布。highspeed 名稱是指模型的服務方式及其回答速度,並非指不同的模型。
我應該使用 M2.5-highspeed 還是 M2.7-highspeed?
若需要技能(skills)和動態工具搜尋等較新的代理功能,請嘗試 M2.7-highspeed。如果您的提示詞已針對 M2.5-highspeed 進行調校且結果穩定,則建議保留使用 M2.5-highspeed。
MiniMax-M2.5-highspeed 的費用是多少?
在 TokenLab 上,MiniMax-M2.5-highspeed 價格為 輸入 $0.60 / 輸出 $2.40 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
MiniMax-M2.5-highspeed 的上下文長度與輸出限制為何?
MiniMax-M2.5-highspeed 支援最高 204,800 tokens 的上下文,單次回應上限為 65,536 tokens。
MiniMax-M2.5-highspeed 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 MiniMax-M2.5-highspeed 的呼叫。下方的請求範例展示了對應的程式碼格式。
MiniMax-M2.5-highspeed 支援哪些操作?
MiniMax-M2.5-highspeed 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 MiniMax-M2.5-highspeed
來源
更新於 2026年10月2日