OpenAI: GPT-5 mini
gpt-5-mini- Entrada / Salida-30%
- $0.25 / $2.00$0.175 / $1.40
- Contexto
- 400K
- Salida máxima
- 128K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de promptsRazonamiento
Sobre GPT-5 mini
GPT-5 mini es el modelo GPT-5 más pequeño de OpenAI, descrito como una versión más rápida y eficiente en costos de GPT-5 para trabajos bien definidos de alto rendimiento. Acepta texto e imágenes, devuelve texto y mantiene tokens de razonamiento, llamadas a funciones y salidas estructuradas. Elíjalo sobre el modelo completo cuando la latencia y el volumen importen más que la precisión máxima.
Puntos fuertes
- Posicionado por OpenAI como la versión más rápida de GPT-5 para aplicaciones sensibles al tiempo y de alto rendimiento.
- Mantiene tokens de razonamiento, por lo que aún puede resolver problemas de varios pasos a menor escala.
- Maneja llamadas a funciones, búsqueda web, búsqueda de archivos y salidas estructuradas como su hermano mayor.
- Acepta entrada de imágenes, lo que permite realizar preguntas sobre capturas de pantalla y documentos sin un modelo de visión separado.
Cuándo buscar otra opción
- Su corte de conocimiento de mayo de 2024 es anterior al de GPT-5 completo, por lo que sabe menos sobre eventos recientes.
- En los razonamientos más difíciles y refactorizaciones grandes, el GPT-5 completo o un nivel Pro es la opción más segura.
- Devuelve solo texto, sin salida de audio o imagen.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoResponses APIPOST/v1/responsesFormato de API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
Precios
El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $0.25 / Salida $2.00 / Lectura de caché $0.025
- Precio Verified
- Entrada $0.175 / Salida $1.40 / Lectura de caché $0.0175
- Descuento
- -30%
Lectura de caché
- Precio Official
- $0.025
- Precio Verified
- $0.0175
- Descuento
- -30%
Se cobra por llamada, solo cuando el modelo utiliza la herramienta.
Búsqueda web
- Precio Official
- $0.01/búsqueda
- Precio Verified
- $0.007/búsqueda
- Descuento
- -30%
| Precio OfficialPor 1M Token | Precio VerifiedPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $0.25 / Salida $2.00 / Lectura de caché $0.025 | Entrada $0.175 / Salida $1.40 / Lectura de caché $0.0175 | -30% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.025 | $0.0175 | -30% |
| Costos de herramientasSe cobra por llamada, solo cuando el modelo utiliza la herramienta. | |||
| Búsqueda web | $0.01/búsqueda | $0.007/búsqueda | -30% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre GPT-5 mini en Console con un prompt listo para editar o enviar.
Ayúdame a probar gpt-5-mini con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Razonamiento
- Visión
Asistentes orientados al cliente
Responda preguntas de productos con llamadas a herramientas en un sistema de pedidos donde el tiempo de respuesta define la experiencia.
Clasificación por lotes
Etiquete miles de tickets o reseñas con un esquema de salida estructurado y categorías consistentes.
Explicación de código y ediciones pequeñas
Explique funciones, escriba pruebas y realice ediciones contenidas cuando un modelo de tamaño completo sea más de lo que la tarea necesita.
Subpasos de agentes
Ejecute búsquedas y resúmenes rutinarios dentro de un flujo de trabajo más grande mientras un modelo más fuerte maneja la planificación.
Ejemplos de prompts
Clasifique este ticket de soporte como facturación, error o solicitud de función y devuelva la etiqueta con una oración de razonamiento.
Resuma esta transcripción de llamada en cinco puntos y enumere cualquier elemento de acción con sus responsables.
Escriba pruebas unitarias para esta función y señale cualquier entrada que no logre manejar.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Qué es GPT-5 mini?
GPT-5 mini es una versión más pequeña de GPT-5 de OpenAI. Está dirigido a trabajos rápidos y conscientes de los costos con un alto volumen de solicitudes, y sigue soportando razonamiento, herramientas y entrada de imágenes.
¿Cuándo debería usar GPT-5 mini en lugar de GPT-5?
Use mini para tareas bien definidas como clasificación, resumen y llamadas a herramientas rutinarias donde la velocidad y el volumen cuentan. Use el GPT-5 completo cuando las respuestas sean incorrectas con demasiada frecuencia en su propio conjunto de evaluación o la tarea requiera un razonamiento más profundo.
¿GPT-5 mini acepta imágenes?
Sí. Entra texto e imágenes y sale texto. Eso cubre la lectura de capturas de pantalla, formularios y gráficos para preguntas o extracción, pero el modelo no puede crear ni editar imágenes por sí mismo.
¿Cuál es el corte de conocimiento de GPT-5 mini?
OpenAI lista el 31 de mayo de 2024 como el corte de conocimiento para este modelo. Cualquier cosa más nueva debe provenir del prompt, de archivos adjuntos o de una llamada a la herramienta de búsqueda web.
¿Es GPT-5 mini más pequeño que GPT-5 nano?
No. Nano es el más pequeño y barato de los dos y está dirigido a resúmenes y clasificación. Mini se sitúa entre nano y el GPT-5 completo en capacidad y costo.
¿Cuánto cuesta GPT-5 mini?
En TokenLab, GPT-5 mini cuesta Entrada $0.175 / Salida $1.40 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de GPT-5 mini?
GPT-5 mini admite hasta 400.000 tokens de contexto y genera hasta 128.000 tokens por respuesta.
¿Qué endpoint debe usar GPT-5 mini?
Utiliza https://api.tokenlab.sh/v1/responses para GPT-5 mini. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta GPT-5 mini?
GPT-5 mini admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar GPT-5 mini
Fuentes
Revisado el 2 oct 2026