Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

OpenAI: GPT-5 mini

GPT-5 pequeno para agentes responsivos, ajuda em codificação e automação cotidiana
Comparar modelos
gpt-5-mini
DisponívelOpenAIChatEntrada em cache 90% mais barata
Entrada / Saída-30%
$0.25 / $2.00$0.175 / $1.40
Contexto
400K
Saída máxima
128K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de promptsRaciocínio

Sobre o GPT-5 mini

O GPT-5 mini é o modelo GPT-5 menor da OpenAI, descrito como uma versão mais rápida e econômica do GPT-5 para trabalhos bem definidos e de alto rendimento. Ele aceita texto e imagens, retorna texto e mantém tokens de raciocínio, chamada de funções e saídas estruturadas. Escolha-o em vez do modelo completo quando a latência e o volume forem mais importantes do que a precisão máxima.

Pontos fortes

  • Posicionado pela OpenAI como a versão mais rápida do GPT-5 para aplicações sensíveis ao tempo e de alto rendimento.
  • Mantém tokens de raciocínio, para que ainda possa resolver problemas de várias etapas em uma escala menor.
  • Lida com chamada de funções, pesquisa na web, pesquisa de arquivos e saídas estruturadas como seu irmão maior.
  • Aceita entrada de imagem, o que permite perguntas sobre capturas de tela e documentos sem um modelo de visão separado.

Quando usar outro modelo

  • Seu corte de conhecimento de maio de 2024 é anterior ao do GPT-5 completo, portanto, ele sabe menos sobre eventos recentes.
  • Nos raciocínios mais difíceis e grandes refatorações, o GPT-5 completo ou uma camada Pro é a escolha mais segura.
  • Ele retorna apenas texto, sem saída de áudio ou imagem.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

Preço

O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.

Especificação padrão

Por 1M Token
Preço Official
Entrada $0.25 / Saída $2.00 / Leitura de cache $0.025
Preço Verified
Entrada $0.175 / Saída $1.40 / Leitura de cache $0.0175
Desconto
-30%
Preços de cache de prompt

Leitura de cache

Preço Official
$0.025
Preço Verified
$0.0175
Desconto
-30%
Taxas de ferramentas

Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.

Pesquisa na web

Preço Official
$0.01/busca
Preço Verified
$0.007/busca
Desconto
-30%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra GPT-5 mini no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar gpt-5-mini com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Raciocínio
  • Visão
  • Assistentes voltados ao cliente

    Responda a perguntas sobre produtos com chamadas de ferramentas para um sistema de pedidos onde o tempo de resposta molda a experiência.

  • Classificação em lote

    Classifique milhares de tickets ou avaliações com um esquema de saída estruturado e categorias consistentes.

  • Explicação de código e pequenas edições

    Explique funções, escreva testes e faça edições contidas quando um modelo de tamanho completo for mais do que a tarefa exige.

  • Subetapas de agente

    Execute pesquisas e resumos de rotina dentro de um fluxo de trabalho maior enquanto um modelo mais forte lida com o planejamento.

Exemplos de prompt

Classifique este ticket de suporte como cobrança, bug ou solicitação de recurso e retorne o rótulo com uma frase de justificativa.

Resuma esta transcrição de chamada em cinco tópicos e liste quaisquer itens de ação com seus responsáveis.

Escreva testes unitários para esta função e aponte qualquer entrada que ela falhe em processar.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

O que é o GPT-5 mini?

O GPT-5 mini é uma versão menor do GPT-5 da OpenAI. Ele é voltado para trabalhos rápidos e econômicos com alto volume de solicitações, e ainda suporta raciocínio, ferramentas e entrada de imagem.

Quando devo usar o GPT-5 mini em vez do GPT-5?

Use o mini para tarefas bem definidas, como classificação, resumo e chamadas de ferramentas de rotina, onde a velocidade e o volume contam. Use o GPT-5 completo quando as respostas estiverem incorretas com muita frequência em seu próprio conjunto de avaliação ou se a tarefa exigir um raciocínio mais profundo.

O GPT-5 mini aceita imagens?

Sim. Texto e imagens entram e texto sai. Isso cobre a leitura de capturas de tela, formulários e gráficos para perguntas ou extração, mas o modelo não pode criar ou editar imagens por si só.

Qual é o corte de conhecimento do GPT-5 mini?

A OpenAI lista 31 de maio de 2024 como o corte de conhecimento para este modelo. Qualquer coisa mais recente deve vir do prompt, de arquivos anexados ou de uma chamada de ferramenta de pesquisa na web.

O GPT-5 mini é menor que o GPT-5 nano?

Não. O nano é o menor e mais barato dos dois e é voltado para resumo e classificação. O mini fica entre o nano e o GPT-5 completo em capacidade e custo.

Quanto custa o GPT-5 mini?

No TokenLab, GPT-5 mini custa Entrada $0.175 / Saída $1.40 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do GPT-5 mini?

O GPT-5 mini aceita até 400.000 tokens de contexto e gera até 128.000 tokens por resposta.

Qual endpoint o GPT-5 mini deve usar?

Use https://api.tokenlab.sh/v1/responses para GPT-5 mini. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o GPT-5 mini suporta?

GPT-5 mini suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar GPT-5 mini

Fontes

Revisado em 2 de out. de 2026

Mais da série GPT 5

Modelos relacionados