- 输入 / 输出-30%
- $0.25 / $2.00$0.175 / $1.40
- 上下文
- 400K
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
GPT-5 mini 简介
GPT-5 mini 是 OpenAI 的小号 GPT-5 模型,被描述为 GPT-5 的更快、更省成本的版本,适合定义明确、吞吐量高的工作。它接受文本和图片,返回文本,保留推理 token、函数调用和结构化输出。当延迟和调用量比最高准确率更重要时,选它而不是完整版。
擅长的任务
- OpenAI 把它定位为 GPT-5 的更快版本,面向对时间敏感、吞吐量高的应用。
- 保留推理 token,所以在较小的规模上仍能处理多步问题。
- 和大号版本一样,支持函数调用、网页搜索、文件搜索和结构化输出。
- 支持图片输入,回答关于截图和文档的问题不需要另用视觉模型。
什么情况换别的模型
- 知识截止到 2024 年 5 月,早于完整的 GPT-5,对近期事件了解较少。
- 遇到最难的推理和大规模重构,完整的 GPT-5 或 Pro 档更稳妥。
- 只返回文本,没有音频或图片输出。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- Official 价格
- 输入 $0.25 / 输出 $2.00 / 缓存读取 $0.025
- Verified 价格
- 输入 $0.175 / 输出 $1.40 / 缓存读取 $0.0175
- 折扣
- -30%
缓存读取
- Official 价格
- $0.025
- Verified 价格
- $0.0175
- 折扣
- -30%
按次计费,仅在模型实际使用工具时收取。
网页搜索
- Official 价格
- $0.01/次搜索
- Verified 价格
- $0.007/次搜索
- 折扣
- -30%
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $0.25 / 输出 $2.00 / 缓存读取 $0.025 | 输入 $0.175 / 输出 $1.40 / 缓存读取 $0.0175 | -30% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.025 | $0.0175 | -30% |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.01/次搜索 | $0.007/次搜索 | -30% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
GPT-5 mini 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 gpt-5-mini 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
面向客户的助手
回答产品问题,并通过工具调用接入订单系统,响应时间会直接影响体验。
批量分类
用结构化输出的结构定义和统一的类别,给成千上万的工单或评论打标签。
代码讲解和小改动
在完整大小的模型对任务来说过剩时,讲解函数、编写测试、做范围明确的修改。
智能体子步骤
在更大的工作流里执行常规查询和总结,规划交给更强的模型。
提示词示例
把这张客服工单分类为 billing、bug 或 feature request,返回标签并附一句理由。
用五个要点总结这段通话记录,并列出待办事项和负责人。
为这个函数写单元测试,并指出它处理不了的输入。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
GPT-5 mini 是什么?
GPT-5 mini 是 OpenAI GPT-5 的小号版本。面向调用量大、注重速度和成本的工作,仍然支持推理、工具和图片输入。
什么时候用 GPT-5 mini,而不是 GPT-5?
范围明确、看重速度和调用量的任务,用 mini,比如分类、总结和常规工具调用。如果在你自己的评测集上答错太多,或任务需要更深的推理,就用完整的 GPT-5。
GPT-5 mini 接受图片吗?
接受。输入文本和图片,输出文本。可以用来读取截图、表单和图表,进行问答或信息提取,但模型本身不能生成或编辑图片。
GPT-5 mini 的知识截止日期是什么时候?
OpenAI 列出的这个模型的知识截止日期是 2024 年 5 月 31 日。更新的内容需要通过提示词、附加文件或网页搜索工具调用来提供。
GPT-5 mini 比 GPT-5 nano 更小吗?
不是。nano 在两者中更小、更便宜,面向总结和分类。mini 在能力和成本上介于 nano 和完整的 GPT-5 之间。
GPT-5 mini 的费用是多少?
在 TokenLab 上,GPT-5 mini 的价格为 输入 $0.175 / 输出 $1.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
GPT-5 mini 的上下文窗口和输出上限是多少?
GPT-5 mini 最多接收 400,000 token 的上下文,单次最多返回 128,000 token。
GPT-5 mini 应该使用哪个端点?
GPT-5 mini 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
GPT-5 mini 支持哪些操作?
GPT-5 mini 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
GPT-5 mini 对比
资料来源
审阅于 2026年10月2日