為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

OpenAI: GPT-5 mini

小型 GPT-5,適用於反應靈敏的代理程式、編碼協助與日常自動化。
比較模型
gpt-5-mini
可用OpenAI對話輸入快取節省 90%
輸入 / 輸出-30%
$0.25 / $2.00$0.175 / $1.40
上下文
400K
最大輸出長度
128K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 GPT-5 mini

GPT-5 mini 是 OpenAI 較小的 GPT-5 模型,被描述為 GPT-5 的更快速且更具成本效益的版本,適用於定義明確、高吞吐量的工作。它接受文字和圖像,返回文字,並保留推理 token、函式呼叫和結構化輸出。當延遲和處理量比峰值準確度更重要時,請選擇它而非完整模型。

適用場景

  • OpenAI 將其定位為 GPT-5 的快速版本,適用於對時間敏感、高吞吐量的應用程式。
  • 保留推理 token,因此它仍然可以在較小規模下處理多步驟問題。
  • 與其較大的同類產品一樣,處理函式呼叫、網頁搜尋、檔案搜尋和結構化輸出。
  • 接收圖像輸入,無需單獨的視覺模型即可進行螢幕截圖和文件提問。

其他選擇建議

  • 其 2024 年 5 月的知識截止日期早於完整版 GPT-5,因此它對近期事件的了解較少。
  • 在最困難的推理和大型重構任務中,完整版 GPT-5 或 Pro 等級是更安全的選擇。
  • 它僅返回文字,沒有音訊或圖像輸出。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

預設規格

每 1M Token
Official 價格
輸入 $0.25 / 輸出 $2.00 / 快取讀取 $0.025
Verified 價格
輸入 $0.175 / 輸出 $1.40 / 快取讀取 $0.0175
折扣
-30%
Prompt 快取價格

快取讀取

Official 價格
$0.025
Verified 價格
$0.0175
折扣
-30%
工具費用

僅在模型呼叫工具時,依使用次數計費。

網路搜尋

Official 價格
$0.01/次搜尋
Verified 價格
$0.007/次搜尋
折扣
-30%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 GPT-5 mini,並準備好編輯或發送提示詞。

協助我使用 gpt-5-mini 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 面向客戶的助理

    透過對訂單系統的工具呼叫來回答產品問題,其中回應時間會影響體驗。

  • 批次分類

    使用結構化輸出架構和一致的類別來標記數千個工單或評論。

  • 程式碼解釋與小幅修改

    當任務不需要完整尺寸的模型時,解釋函式、編寫測試並進行受限的修改。

  • 代理子步驟

    在更大的工作流程中執行常規查詢和總結,同時由更強大的模型處理規劃。

提示詞範例

將此支援工單分類為帳單、錯誤或功能請求,並返回帶有一句推理說明的標籤。

將此通話記錄總結為五個要點,並列出任何負責人的待辦事項。

為此函式編寫單元測試,並指出它無法處理的任何輸入。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 GPT-5 mini?

GPT-5 mini 是 OpenAI GPT-5 的較小版本。它旨在處理快速、具成本意識且請求量大的工作,並且仍然支援推理、工具和圖像輸入。

我應該何時使用 GPT-5 mini 而不是 GPT-5?

對於分類、總結和常規工具呼叫等範圍明確的任務,請使用 mini,因為速度和處理量很重要。當您在自己的評估集上發現答案經常錯誤,或者任務需要更深層的推理時,請使用完整版 GPT-5。

GPT-5 mini 接受圖像嗎?

是的。輸入文字和圖像,輸出文字。這涵蓋了讀取螢幕截圖、表單和圖表以進行提問或提取,但模型本身無法建立或編輯圖像。

GPT-5 mini 的知識截止日期是什麼時候?

OpenAI 將 2024 年 5 月 31 日列為此模型的知識截止日期。任何更新的資訊都必須來自提示詞、附加檔案或網頁搜尋工具呼叫。

GPT-5 mini 比 GPT-5 nano 小嗎?

不是。Nano 是兩者中更小且更便宜的,旨在進行總結和分類。Mini 在能力和成本上介於 Nano 和完整版 GPT-5 之間。

GPT-5 mini 的費用是多少?

在 TokenLab 上,GPT-5 mini 價格為 輸入 $0.175 / 輸出 $1.40 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

GPT-5 mini 的上下文長度與輸出限制為何?

GPT-5 mini 支援最高 400,000 tokens 的上下文,單次回應上限為 128,000 tokens。

GPT-5 mini 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 GPT-5 mini 的呼叫。下方的請求範例展示了對應的程式碼格式。

GPT-5 mini 支援哪些操作?

GPT-5 mini 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 GPT-5 mini

來源

更新於 2026年10月2日

更多來自 GPT 5 的模型

相關模型