- 輸入 / 輸出-30%
- $0.25 / $2.00$0.175 / $1.40
- 上下文
- 400K
- 最大輸出長度
- 128K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 GPT-5 mini
GPT-5 mini 是 OpenAI 較小的 GPT-5 模型,被描述為 GPT-5 的更快速且更具成本效益的版本,適用於定義明確、高吞吐量的工作。它接受文字和圖像,返回文字,並保留推理 token、函式呼叫和結構化輸出。當延遲和處理量比峰值準確度更重要時,請選擇它而非完整模型。
適用場景
- OpenAI 將其定位為 GPT-5 的快速版本,適用於對時間敏感、高吞吐量的應用程式。
- 保留推理 token,因此它仍然可以在較小規模下處理多步驟問題。
- 與其較大的同類產品一樣,處理函式呼叫、網頁搜尋、檔案搜尋和結構化輸出。
- 接收圖像輸入,無需單獨的視覺模型即可進行螢幕截圖和文件提問。
其他選擇建議
- 其 2024 年 5 月的知識截止日期早於完整版 GPT-5,因此它對近期事件的了解較少。
- 在最困難的推理和大型重構任務中,完整版 GPT-5 或 Pro 等級是更安全的選擇。
- 它僅返回文字,沒有音訊或圖像輸出。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
定價
Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。
預設規格
每 1M Token- Official 價格
- 輸入 $0.25 / 輸出 $2.00 / 快取讀取 $0.025
- Verified 價格
- 輸入 $0.175 / 輸出 $1.40 / 快取讀取 $0.0175
- 折扣
- -30%
快取讀取
- Official 價格
- $0.025
- Verified 價格
- $0.0175
- 折扣
- -30%
僅在模型呼叫工具時,依使用次數計費。
網路搜尋
- Official 價格
- $0.01/次搜尋
- Verified 價格
- $0.007/次搜尋
- 折扣
- -30%
| Official 價格每 1M Token | Verified 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $0.25 / 輸出 $2.00 / 快取讀取 $0.025 | 輸入 $0.175 / 輸出 $1.40 / 快取讀取 $0.0175 | -30% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.025 | $0.0175 | -30% |
| 工具費用僅在模型呼叫工具時,依使用次數計費。 | |||
| 網路搜尋 | $0.01/次搜尋 | $0.007/次搜尋 | -30% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 GPT-5 mini,並準備好編輯或發送提示詞。
協助我使用 gpt-5-mini 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
面向客戶的助理
透過對訂單系統的工具呼叫來回答產品問題,其中回應時間會影響體驗。
批次分類
使用結構化輸出架構和一致的類別來標記數千個工單或評論。
程式碼解釋與小幅修改
當任務不需要完整尺寸的模型時,解釋函式、編寫測試並進行受限的修改。
代理子步驟
在更大的工作流程中執行常規查詢和總結,同時由更強大的模型處理規劃。
提示詞範例
將此支援工單分類為帳單、錯誤或功能請求,並返回帶有一句推理說明的標籤。
將此通話記錄總結為五個要點,並列出任何負責人的待辦事項。
為此函式編寫單元測試,並指出它無法處理的任何輸入。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
什麼是 GPT-5 mini?
GPT-5 mini 是 OpenAI GPT-5 的較小版本。它旨在處理快速、具成本意識且請求量大的工作,並且仍然支援推理、工具和圖像輸入。
我應該何時使用 GPT-5 mini 而不是 GPT-5?
對於分類、總結和常規工具呼叫等範圍明確的任務,請使用 mini,因為速度和處理量很重要。當您在自己的評估集上發現答案經常錯誤,或者任務需要更深層的推理時,請使用完整版 GPT-5。
GPT-5 mini 接受圖像嗎?
是的。輸入文字和圖像,輸出文字。這涵蓋了讀取螢幕截圖、表單和圖表以進行提問或提取,但模型本身無法建立或編輯圖像。
GPT-5 mini 的知識截止日期是什麼時候?
OpenAI 將 2024 年 5 月 31 日列為此模型的知識截止日期。任何更新的資訊都必須來自提示詞、附加檔案或網頁搜尋工具呼叫。
GPT-5 mini 比 GPT-5 nano 小嗎?
不是。Nano 是兩者中更小且更便宜的,旨在進行總結和分類。Mini 在能力和成本上介於 Nano 和完整版 GPT-5 之間。
GPT-5 mini 的費用是多少?
在 TokenLab 上,GPT-5 mini 價格為 輸入 $0.175 / 輸出 $1.40 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
GPT-5 mini 的上下文長度與輸出限制為何?
GPT-5 mini 支援最高 400,000 tokens 的上下文,單次回應上限為 128,000 tokens。
GPT-5 mini 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 GPT-5 mini 的呼叫。下方的請求範例展示了對應的程式碼格式。
GPT-5 mini 支援哪些操作?
GPT-5 mini 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 GPT-5 mini
來源
更新於 2026年10月2日