Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Google: Gemini 3.7 Flash

Modelo Gemini de alta eficiência para fluxos de trabalho agenticos, codificação e raciocínio multimodal
Comparar modelos
gemini-3.7-flash
DisponívelGoogleChatEntrada em cache 90% mais barata
Entrada / Saída-50%
$0.75 / $3.75$0.375 / $1.88
Contexto
1M
Lançado
13 de ago. de 2026
Saída máxima
64K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de prompts

Sobre o Gemini 3.7 Flash

O Gemini 3.7 Flash é um modelo estável da categoria Flash do Google, lançado em agosto de 2026, que o Google descreve como sendo criado para codificação complexa, fluxos de trabalho de agentes e execução confiável de várias etapas. Ele lê texto e imagens, suporta raciocínio (thinking), chama ferramentas, retorna JSON vinculado a esquema e faz cache de contexto. Ele está um nível acima do 3.6 Flash e um nível abaixo do 3.8 Flash.

Pontos fortes

  • O raciocínio pode ser executado antes da resposta, o que ajuda em tarefas de codificação e de várias etapas.
  • A execução confiável de várias etapas é o objetivo de design declarado, útil quando um agente não pode perder o fio da meada.
  • A chamada de ferramentas e o JSON vinculado a esquema tornam os resultados fáceis de serem integrados a outros sistemas.
  • A entrada de imagem lida com capturas de tela, diagramas e documentos digitalizados.

Quando usar outro modelo

  • O Gemini 3.8 Flash é o modelo mais recente que o Google apresenta como sua categoria Flash mais capaz.
  • O raciocínio adiciona latência, portanto, consultas simples são melhor atendidas pelo Flash-Lite.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    Formato da API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preço

O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.

Promotional Standard

Por 1M Token
Preço Official
Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
Preço Verified
Entrada $0.375 / Saída $1.88 / Leitura de cache $0.0375
Desconto
-50%
Preços de cache de prompt

Leitura de cache

Preço Official
$0.075
Preço Verified
$0.0375
Desconto
-50%
Taxas de ferramentas

Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.

Pesquisa na web

Preço Official
$0.014/busca
Preço Verified
$0.007/busca
Desconto
-50%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
99,8%
Latência mediana em 7 dias
14 sn=254
Latência P95 em 7 dias
54,5 sn=254
Requisições em 30 dias
1K+
Última atividade
há 10 horas

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Gemini 3.7 Flash no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar gemini-3.7-flash com uma mensagem em /v1beta/models/gemini-3.7-flash:generateContent. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Visão
  • Implementação de recursos

    Faça com que um agente leia um ticket, edite vários arquivos e execute testes.

  • Automação de fluxo de trabalho

    Encadeie aprovações, consultas e notificações onde cada etapa depende da anterior.

  • Revisão de código

    Leia um diff, sinalize alterações arriscadas e explique cada descoberta para que um revisor humano possa decidir rapidamente o que aceitar.

  • Limpeza de dados

    Raciocine sobre registros inconsistentes e proponha regras de normalização antes de aplicá-las, para que a limpeza possa ser auditada primeiro.

Exemplos de prompt

Leia este ticket e os arquivos vinculados, implemente a alteração e liste quais testes você executou.

Revise este diff em busca de bugs de concorrência e classifique as descobertas por gravidade.

Estes dois registros de cliente parecem duplicados. Explique quais campos conflitam e qual regra os mesclaria com segurança.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Para que o Gemini 3.7 Flash foi projetado?

Codificação complexa, fluxos de trabalho de agentes e execução de várias etapas que precisam permanecer confiáveis do início ao fim. É um modelo Flash com capacidade de raciocínio e suporte a ferramentas e imagens.

Ele suporta raciocínio?

Sim. Ele pode raciocinar antes de responder, o que melhora os resultados em código e planejamento. Mantenha esse esforço baixo para turnos interativos curtos para manter as respostas rápidas.

Como ele difere do 3.6 Flash?

O 3.7 Flash é o modelo posterior e adiciona raciocínio, com uma ênfase maior em execuções confiáveis de várias etapas. O 3.6 Flash é estruturado em torno de loops de codificação e raciocínio visual sem raciocínio (thinking).

O 3.8 Flash é uma escolha melhor?

Frequentemente, para engenharia de software de longo prazo. O 3.7 Flash continua sendo uma escolha sólida quando você já ajustou os prompts para ele e seus resultados atendem ao seu padrão.

Quanto custa o Gemini 3.7 Flash?

No TokenLab, Gemini 3.7 Flash custa Entrada $0.375 / Saída $1.88 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Gemini 3.7 Flash?

O Gemini 3.7 Flash aceita até 1.048.576 tokens de contexto e gera até 65.536 tokens por resposta.

Qual endpoint o Gemini 3.7 Flash deve usar?

Use https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent para Gemini 3.7 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Gemini 3.7 Flash suporta?

Gemini 3.7 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Gemini 3.7 Flash

Fontes

Revisado em 2 de out. de 2026

Mais da série Gemini 3

Modelos relacionados