每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

OpenAI: GPT-5 mini

小型 GPT-5,面向即时响应的智能体、编程辅助与日常自动化
对比模型
gpt-5-mini
可用OpenAI聊天缓存输入便宜 90%
输入 / 输出-30%
$0.25 / $2.00$0.175 / $1.40
上下文
400K
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

GPT-5 mini 简介

GPT-5 mini 是 OpenAI 的小号 GPT-5 模型,被描述为 GPT-5 的更快、更省成本的版本,适合定义明确、吞吐量高的工作。它接受文本和图片,返回文本,保留推理 token、函数调用和结构化输出。当延迟和调用量比最高准确率更重要时,选它而不是完整版。

擅长的任务

  • OpenAI 把它定位为 GPT-5 的更快版本,面向对时间敏感、吞吐量高的应用。
  • 保留推理 token,所以在较小的规模上仍能处理多步问题。
  • 和大号版本一样,支持函数调用、网页搜索、文件搜索和结构化输出。
  • 支持图片输入,回答关于截图和文档的问题不需要另用视觉模型。

什么情况换别的模型

  • 知识截止到 2024 年 5 月,早于完整的 GPT-5,对近期事件了解较少。
  • 遇到最难的推理和大规模重构,完整的 GPT-5 或 Pro 档更稳妥。
  • 只返回文本,没有音频或图片输出。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
Official 价格
输入 $0.25 / 输出 $2.00 / 缓存读取 $0.025
Verified 价格
输入 $0.175 / 输出 $1.40 / 缓存读取 $0.0175
折扣
-30%
提示词缓存价格

缓存读取

Official 价格
$0.025
Verified 价格
$0.0175
折扣
-30%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

Official 价格
$0.01/次搜索
Verified 价格
$0.007/次搜索
折扣
-30%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

GPT-5 mini 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 gpt-5-mini 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 面向客户的助手

    回答产品问题,并通过工具调用接入订单系统,响应时间会直接影响体验。

  • 批量分类

    用结构化输出的结构定义和统一的类别,给成千上万的工单或评论打标签。

  • 代码讲解和小改动

    在完整大小的模型对任务来说过剩时,讲解函数、编写测试、做范围明确的修改。

  • 智能体子步骤

    在更大的工作流里执行常规查询和总结,规划交给更强的模型。

提示词示例

把这张客服工单分类为 billing、bug 或 feature request,返回标签并附一句理由。

用五个要点总结这段通话记录,并列出待办事项和负责人。

为这个函数写单元测试,并指出它处理不了的输入。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

GPT-5 mini 是什么?

GPT-5 mini 是 OpenAI GPT-5 的小号版本。面向调用量大、注重速度和成本的工作,仍然支持推理、工具和图片输入。

什么时候用 GPT-5 mini,而不是 GPT-5?

范围明确、看重速度和调用量的任务,用 mini,比如分类、总结和常规工具调用。如果在你自己的评测集上答错太多,或任务需要更深的推理,就用完整的 GPT-5。

GPT-5 mini 接受图片吗?

接受。输入文本和图片,输出文本。可以用来读取截图、表单和图表,进行问答或信息提取,但模型本身不能生成或编辑图片。

GPT-5 mini 的知识截止日期是什么时候?

OpenAI 列出的这个模型的知识截止日期是 2024 年 5 月 31 日。更新的内容需要通过提示词、附加文件或网页搜索工具调用来提供。

GPT-5 mini 比 GPT-5 nano 更小吗?

不是。nano 在两者中更小、更便宜,面向总结和分类。mini 在能力和成本上介于 nano 和完整的 GPT-5 之间。

GPT-5 mini 的费用是多少?

在 TokenLab 上,GPT-5 mini 的价格为 输入 $0.175 / 输出 $1.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

GPT-5 mini 的上下文窗口和输出上限是多少?

GPT-5 mini 最多接收 400,000 token 的上下文,单次最多返回 128,000 token。

GPT-5 mini 应该使用哪个端点?

GPT-5 mini 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

GPT-5 mini 支持哪些操作?

GPT-5 mini 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

GPT-5 mini 对比

资料来源

审阅于 2026年10月2日

更多 GPT 5 模型

相关模型