Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

OpenAI: GPT-5 mini

GPT-5 pequeño para agentes receptivos, ayuda en codificación y automatización cotidiana
Comparar modelos
gpt-5-mini
DisponibleOpenAIChatEntrada en caché 90% más barata
Entrada / Salida-30%
$0.25 / $2.00$0.175 / $1.40
Contexto
400K
Salida máxima
128K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Sobre GPT-5 mini

GPT-5 mini es el modelo GPT-5 más pequeño de OpenAI, descrito como una versión más rápida y eficiente en costos de GPT-5 para trabajos bien definidos de alto rendimiento. Acepta texto e imágenes, devuelve texto y mantiene tokens de razonamiento, llamadas a funciones y salidas estructuradas. Elíjalo sobre el modelo completo cuando la latencia y el volumen importen más que la precisión máxima.

Puntos fuertes

  • Posicionado por OpenAI como la versión más rápida de GPT-5 para aplicaciones sensibles al tiempo y de alto rendimiento.
  • Mantiene tokens de razonamiento, por lo que aún puede resolver problemas de varios pasos a menor escala.
  • Maneja llamadas a funciones, búsqueda web, búsqueda de archivos y salidas estructuradas como su hermano mayor.
  • Acepta entrada de imágenes, lo que permite realizar preguntas sobre capturas de pantalla y documentos sin un modelo de visión separado.

Cuándo buscar otra opción

  • Su corte de conocimiento de mayo de 2024 es anterior al de GPT-5 completo, por lo que sabe menos sobre eventos recientes.
  • En los razonamientos más difíciles y refactorizaciones grandes, el GPT-5 completo o un nivel Pro es la opción más segura.
  • Devuelve solo texto, sin salida de audio o imagen.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoResponses API
    POST/v1/responses
    Formato de API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $0.25 / Salida $2.00 / Lectura de caché $0.025
Precio Verified
Entrada $0.175 / Salida $1.40 / Lectura de caché $0.0175
Descuento
-30%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.025
Precio Verified
$0.0175
Descuento
-30%
Costos de herramientas

Se cobra por llamada, solo cuando el modelo utiliza la herramienta.

Búsqueda web

Precio Official
$0.01/búsqueda
Precio Verified
$0.007/búsqueda
Descuento
-30%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre GPT-5 mini en Console con un prompt listo para editar o enviar.

Ayúdame a probar gpt-5-mini con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Razonamiento
  • Visión
  • Asistentes orientados al cliente

    Responda preguntas de productos con llamadas a herramientas en un sistema de pedidos donde el tiempo de respuesta define la experiencia.

  • Clasificación por lotes

    Etiquete miles de tickets o reseñas con un esquema de salida estructurado y categorías consistentes.

  • Explicación de código y ediciones pequeñas

    Explique funciones, escriba pruebas y realice ediciones contenidas cuando un modelo de tamaño completo sea más de lo que la tarea necesita.

  • Subpasos de agentes

    Ejecute búsquedas y resúmenes rutinarios dentro de un flujo de trabajo más grande mientras un modelo más fuerte maneja la planificación.

Ejemplos de prompts

Clasifique este ticket de soporte como facturación, error o solicitud de función y devuelva la etiqueta con una oración de razonamiento.

Resuma esta transcripción de llamada en cinco puntos y enumere cualquier elemento de acción con sus responsables.

Escriba pruebas unitarias para esta función y señale cualquier entrada que no logre manejar.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Qué es GPT-5 mini?

GPT-5 mini es una versión más pequeña de GPT-5 de OpenAI. Está dirigido a trabajos rápidos y conscientes de los costos con un alto volumen de solicitudes, y sigue soportando razonamiento, herramientas y entrada de imágenes.

¿Cuándo debería usar GPT-5 mini en lugar de GPT-5?

Use mini para tareas bien definidas como clasificación, resumen y llamadas a herramientas rutinarias donde la velocidad y el volumen cuentan. Use el GPT-5 completo cuando las respuestas sean incorrectas con demasiada frecuencia en su propio conjunto de evaluación o la tarea requiera un razonamiento más profundo.

¿GPT-5 mini acepta imágenes?

Sí. Entra texto e imágenes y sale texto. Eso cubre la lectura de capturas de pantalla, formularios y gráficos para preguntas o extracción, pero el modelo no puede crear ni editar imágenes por sí mismo.

¿Cuál es el corte de conocimiento de GPT-5 mini?

OpenAI lista el 31 de mayo de 2024 como el corte de conocimiento para este modelo. Cualquier cosa más nueva debe provenir del prompt, de archivos adjuntos o de una llamada a la herramienta de búsqueda web.

¿Es GPT-5 mini más pequeño que GPT-5 nano?

No. Nano es el más pequeño y barato de los dos y está dirigido a resúmenes y clasificación. Mini se sitúa entre nano y el GPT-5 completo en capacidad y costo.

¿Cuánto cuesta GPT-5 mini?

En TokenLab, GPT-5 mini cuesta Entrada $0.175 / Salida $1.40 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de GPT-5 mini?

GPT-5 mini admite hasta 400.000 tokens de contexto y genera hasta 128.000 tokens por respuesta.

¿Qué endpoint debe usar GPT-5 mini?

Utiliza https://api.tokenlab.sh/v1/responses para GPT-5 mini. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta GPT-5 mini?

GPT-5 mini admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar GPT-5 mini

Fuentes

Revisado el 2 oct 2026

Más de GPT 5

Modelos relacionados