Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Google: Gemini 3.6 Flash

O Gemini 3.6 Flash foca em loops de codificação eficientes, orquestração de ferramentas e raciocínio visual. É uma opção útil para agentes que inspecionam resultados repetidamente, revisam código e decidem a próxima ação dentro de uma tarefa maior.
Comparar modelos
gemini-3.6-flash
DisponívelGoogleChatEntrada em cache 90% mais barata
Entrada / Saída
$0.75 / $3.75
Contexto
1M
Lançado
21 de jul. de 2026
Saída máxima
64K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de prompts

Sobre o Gemini 3.6 Flash

O Gemini 3.6 Flash é um modelo estável da categoria Flash do Google, descrito como um equilíbrio entre velocidade e capacidade multimodal. Foi lançado em julho de 2026, entre o Flash 3.5 e o Flash 3.7. O Google o estrutura em torno de loops de codificação eficientes, orquestração de ferramentas e raciocínio visual, sendo adequado para agentes que inspecionam um resultado, revisam e decidem a próxima ação.

Pontos fortes

  • Adequado para loops nos quais um agente executa código, lê a saída e revisa.
  • A orquestração de ferramentas em várias chamadas é um foco declarado.
  • O raciocínio visual sobre capturas de tela e diagramas funciona na mesma solicitação que o texto.
  • JSON vinculado a esquema e cache oferecem suporte ao uso repetível em produção.

Quando usar outro modelo

  • O Flash 3.7 e 3.8 são mais recentes e voltados para codificação mais complexa e execuções autônomas mais longas.
  • Ele não possui um modo de pensamento dedicado, portanto, deliberações profundas são mais bem feitas em um modelo Pro.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoGemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    Formato da API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preço

O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.

Especificação padrão

Por 1M Token
Preço oficial
Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
Preço da TokenLab
Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
Desconto
—
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.075
Preço da TokenLab
$0.075
Desconto
—
Taxas de ferramentas

Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.

Pesquisa na web

Preço oficial
$0.014/busca
Preço da TokenLab
$0.007/busca
Desconto
-50%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
99,7%
Requisições em 30 dias
100+
Última atividade
há 17 horas

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Gemini 3.6 Flash no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar gemini-3.6-flash com uma mensagem em /v1beta/models/gemini-3.6-flash:generateContent. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Visão
  • Loops de correção de código

    Permitir que um agente execute testes, leia falhas, corrija arquivos e repita até que passem.

  • Inspeção de interface (UI)

    Comparar uma captura de tela com uma especificação escrita e listar cada incompatibilidade de espaçamento, cor ou layout que um revisor deva corrigir.

  • Assistentes com uso intensivo de ferramentas

    Coordenar chamadas de pesquisa, calendário e CRM dentro de uma única conversa, passando resultados de cada ferramenta para a próxima decisão.

  • Perguntas e respostas multimodais

    Responder a perguntas que exigem tanto a imagem de um gráfico quanto o texto do relatório correspondente.

Exemplos de prompt

Execute os testes, leia a saída de falha e altere apenas a função que quebra o segundo teste.

Compare esta captura de tela com a especificação de design e liste cada incompatibilidade de espaçamento ou cor.

Verifique meu calendário e o CRM, depois redija uma resposta propondo dois horários de reunião.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Em que o Gemini 3.6 Flash é melhor?

Trabalho iterativo de agentes: loops de codificação, orquestração de ferramentas e raciocínio sobre imagens. Ele equilibra velocidade com capacidade multimodal, o que o torna um padrão razoável para agentes que não precisam do Flash mais recente.

Como ele é diferente do Flash 3.5?

O 3.6 é o lançamento posterior e é descrito em torno de loops de codificação e uso de ferramentas, enquanto o Flash 3.5 é a base para trabalho rotineiro de alto volume. Espere um melhor comportamento de agente do 3.6.

Devo migrar para o Flash 3.8?

Se você executa tarefas de software longas ou fluxos empresariais complexos, o Flash 3.8 é o que o Google posiciona para esses casos. Para agentes mais simples, o 3.6 pode ser suficiente; execute ambos em seus próprios rastreamentos.

Ele aceita imagens?

Sim. Imagens e texto podem ser combinados em uma única solicitação, e o modelo responde em texto ou em JSON que segue um esquema fornecido por você. Ele não gera imagens por conta própria.

Quanto custa o Gemini 3.6 Flash?

No TokenLab, Gemini 3.6 Flash custa Entrada $0.75 / Saída $3.75 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Gemini 3.6 Flash?

O Gemini 3.6 Flash aceita até 1.048.576 tokens de contexto e gera até 65.536 tokens por resposta.

Qual endpoint o Gemini 3.6 Flash deve usar?

Use https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent para Gemini 3.6 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Gemini 3.6 Flash suporta?

Gemini 3.6 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Gemini 3.6 Flash

Fontes

Revisado em 2 de out. de 2026

Mais da série Gemini 3

Modelos relacionados