Google: Gemini 3.7 Flash
gemini-3.7-flash- Entrada / Saída-50%
- $0.75 / $3.75$0.375 / $1.88
- Contexto
- 1M
- Lançado
- 13 de ago. de 2026
- Saída máxima
- 64K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o Gemini 3.7 Flash
O Gemini 3.7 Flash é um modelo estável da categoria Flash do Google, lançado em agosto de 2026, que o Google descreve como sendo criado para codificação complexa, fluxos de trabalho de agentes e execução confiável de várias etapas. Ele lê texto e imagens, suporta raciocínio (thinking), chama ferramentas, retorna JSON vinculado a esquema e faz cache de contexto. Ele está um nível acima do 3.6 Flash e um nível abaixo do 3.8 Flash.
Pontos fortes
- O raciocínio pode ser executado antes da resposta, o que ajuda em tarefas de codificação e de várias etapas.
- A execução confiável de várias etapas é o objetivo de design declarado, útil quando um agente não pode perder o fio da meada.
- A chamada de ferramentas e o JSON vinculado a esquema tornam os resultados fáceis de serem integrados a outros sistemas.
- A entrada de imagem lida com capturas de tela, diagramas e documentos digitalizados.
Quando usar outro modelo
- O Gemini 3.8 Flash é o modelo mais recente que o Google apresenta como sua categoria Flash mais capaz.
- O raciocínio adiciona latência, portanto, consultas simples são melhor atendidas pelo Flash-Lite.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoGemini APIPOST/v1beta/models/gemini-3.7-flash:generateContentFormato da API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preço
O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.
Promotional Standard
Por 1M Token- Preço Official
- Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
- Preço Verified
- Entrada $0.375 / Saída $1.88 / Leitura de cache $0.0375
- Desconto
- -50%
Leitura de cache
- Preço Official
- $0.075
- Preço Verified
- $0.0375
- Desconto
- -50%
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço Official
- $0.014/busca
- Preço Verified
- $0.007/busca
- Desconto
- -50%
| Preço OfficialPor 1M Token | Preço VerifiedPor 1M Token | Desconto | |
|---|---|---|---|
| Promotional Standard | Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075 | Entrada $0.375 / Saída $1.88 / Leitura de cache $0.0375 | -50% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.075 | $0.0375 | -50% |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.014/busca | $0.007/busca | -50% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 99,8%
- Latência mediana em 7 dias
- 14 sn=254
- Latência P95 em 7 dias
- 54,5 sn=254
- Requisições em 30 dias
- 1K+
- Última atividade
- há 10 horas
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Gemini 3.7 Flash no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar gemini-3.7-flash com uma mensagem em /v1beta/models/gemini-3.7-flash:generateContent. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Visão
Implementação de recursos
Faça com que um agente leia um ticket, edite vários arquivos e execute testes.
Automação de fluxo de trabalho
Encadeie aprovações, consultas e notificações onde cada etapa depende da anterior.
Revisão de código
Leia um diff, sinalize alterações arriscadas e explique cada descoberta para que um revisor humano possa decidir rapidamente o que aceitar.
Limpeza de dados
Raciocine sobre registros inconsistentes e proponha regras de normalização antes de aplicá-las, para que a limpeza possa ser auditada primeiro.
Exemplos de prompt
Leia este ticket e os arquivos vinculados, implemente a alteração e liste quais testes você executou.
Revise este diff em busca de bugs de concorrência e classifique as descobertas por gravidade.
Estes dois registros de cliente parecem duplicados. Explique quais campos conflitam e qual regra os mesclaria com segurança.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Para que o Gemini 3.7 Flash foi projetado?
Codificação complexa, fluxos de trabalho de agentes e execução de várias etapas que precisam permanecer confiáveis do início ao fim. É um modelo Flash com capacidade de raciocínio e suporte a ferramentas e imagens.
Ele suporta raciocínio?
Sim. Ele pode raciocinar antes de responder, o que melhora os resultados em código e planejamento. Mantenha esse esforço baixo para turnos interativos curtos para manter as respostas rápidas.
Como ele difere do 3.6 Flash?
O 3.7 Flash é o modelo posterior e adiciona raciocínio, com uma ênfase maior em execuções confiáveis de várias etapas. O 3.6 Flash é estruturado em torno de loops de codificação e raciocínio visual sem raciocínio (thinking).
O 3.8 Flash é uma escolha melhor?
Frequentemente, para engenharia de software de longo prazo. O 3.7 Flash continua sendo uma escolha sólida quando você já ajustou os prompts para ele e seus resultados atendem ao seu padrão.
Quanto custa o Gemini 3.7 Flash?
No TokenLab, Gemini 3.7 Flash custa Entrada $0.375 / Saída $1.88 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Gemini 3.7 Flash?
O Gemini 3.7 Flash aceita até 1.048.576 tokens de contexto e gera até 65.536 tokens por resposta.
Qual endpoint o Gemini 3.7 Flash deve usar?
Use https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent para Gemini 3.7 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Gemini 3.7 Flash suporta?
Gemini 3.7 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Gemini 3.7 Flash
Fontes
Revisado em 2 de out. de 2026