OpenAI: GPT-5 mini
gpt-5-mini- Entrada / Saída-30%
- $0.25 / $2.00$0.175 / $1.40
- Contexto
- 400K
- Saída máxima
- 128K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Sobre o GPT-5 mini
O GPT-5 mini é o modelo GPT-5 menor da OpenAI, descrito como uma versão mais rápida e econômica do GPT-5 para trabalhos bem definidos e de alto rendimento. Ele aceita texto e imagens, retorna texto e mantém tokens de raciocínio, chamada de funções e saídas estruturadas. Escolha-o em vez do modelo completo quando a latência e o volume forem mais importantes do que a precisão máxima.
Pontos fortes
- Posicionado pela OpenAI como a versão mais rápida do GPT-5 para aplicações sensíveis ao tempo e de alto rendimento.
- Mantém tokens de raciocínio, para que ainda possa resolver problemas de várias etapas em uma escala menor.
- Lida com chamada de funções, pesquisa na web, pesquisa de arquivos e saídas estruturadas como seu irmão maior.
- Aceita entrada de imagem, o que permite perguntas sobre capturas de tela e documentos sem um modelo de visão separado.
Quando usar outro modelo
- Seu corte de conhecimento de maio de 2024 é anterior ao do GPT-5 completo, portanto, ele sabe menos sobre eventos recentes.
- Nos raciocínios mais difíceis e grandes refatorações, o GPT-5 completo ou uma camada Pro é a escolha mais segura.
- Ele retorna apenas texto, sem saída de áudio ou imagem.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoResponses APIPOST/v1/responsesFormato da API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
Preço
O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.
Especificação padrão
Por 1M Token- Preço Official
- Entrada $0.25 / Saída $2.00 / Leitura de cache $0.025
- Preço Verified
- Entrada $0.175 / Saída $1.40 / Leitura de cache $0.0175
- Desconto
- -30%
Leitura de cache
- Preço Official
- $0.025
- Preço Verified
- $0.0175
- Desconto
- -30%
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço Official
- $0.01/busca
- Preço Verified
- $0.007/busca
- Desconto
- -30%
| Preço OfficialPor 1M Token | Preço VerifiedPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $0.25 / Saída $2.00 / Leitura de cache $0.025 | Entrada $0.175 / Saída $1.40 / Leitura de cache $0.0175 | -30% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.025 | $0.0175 | -30% |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.01/busca | $0.007/busca | -30% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra GPT-5 mini no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar gpt-5-mini com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Raciocínio
- Visão
Assistentes voltados ao cliente
Responda a perguntas sobre produtos com chamadas de ferramentas para um sistema de pedidos onde o tempo de resposta molda a experiência.
Classificação em lote
Classifique milhares de tickets ou avaliações com um esquema de saída estruturado e categorias consistentes.
Explicação de código e pequenas edições
Explique funções, escreva testes e faça edições contidas quando um modelo de tamanho completo for mais do que a tarefa exige.
Subetapas de agente
Execute pesquisas e resumos de rotina dentro de um fluxo de trabalho maior enquanto um modelo mais forte lida com o planejamento.
Exemplos de prompt
Classifique este ticket de suporte como cobrança, bug ou solicitação de recurso e retorne o rótulo com uma frase de justificativa.
Resuma esta transcrição de chamada em cinco tópicos e liste quaisquer itens de ação com seus responsáveis.
Escreva testes unitários para esta função e aponte qualquer entrada que ela falhe em processar.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
O que é o GPT-5 mini?
O GPT-5 mini é uma versão menor do GPT-5 da OpenAI. Ele é voltado para trabalhos rápidos e econômicos com alto volume de solicitações, e ainda suporta raciocínio, ferramentas e entrada de imagem.
Quando devo usar o GPT-5 mini em vez do GPT-5?
Use o mini para tarefas bem definidas, como classificação, resumo e chamadas de ferramentas de rotina, onde a velocidade e o volume contam. Use o GPT-5 completo quando as respostas estiverem incorretas com muita frequência em seu próprio conjunto de avaliação ou se a tarefa exigir um raciocínio mais profundo.
O GPT-5 mini aceita imagens?
Sim. Texto e imagens entram e texto sai. Isso cobre a leitura de capturas de tela, formulários e gráficos para perguntas ou extração, mas o modelo não pode criar ou editar imagens por si só.
Qual é o corte de conhecimento do GPT-5 mini?
A OpenAI lista 31 de maio de 2024 como o corte de conhecimento para este modelo. Qualquer coisa mais recente deve vir do prompt, de arquivos anexados ou de uma chamada de ferramenta de pesquisa na web.
O GPT-5 mini é menor que o GPT-5 nano?
Não. O nano é o menor e mais barato dos dois e é voltado para resumo e classificação. O mini fica entre o nano e o GPT-5 completo em capacidade e custo.
Quanto custa o GPT-5 mini?
No TokenLab, GPT-5 mini custa Entrada $0.175 / Saída $1.40 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do GPT-5 mini?
O GPT-5 mini aceita até 400.000 tokens de contexto e gera até 128.000 tokens por resposta.
Qual endpoint o GPT-5 mini deve usar?
Use https://api.tokenlab.sh/v1/responses para GPT-5 mini. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o GPT-5 mini suporta?
GPT-5 mini suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar GPT-5 mini
Fontes
Revisado em 2 de out. de 2026