Google: Gemini 3.6 Flash
gemini-3.6-flash- Entrada / Saída
- $0.75 / $3.75
- Contexto
- 1M
- Lançado
- 21 de jul. de 2026
- Saída máxima
- 64K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o Gemini 3.6 Flash
O Gemini 3.6 Flash é um modelo estável da categoria Flash do Google, descrito como um equilíbrio entre velocidade e capacidade multimodal. Foi lançado em julho de 2026, entre o Flash 3.5 e o Flash 3.7. O Google o estrutura em torno de loops de codificação eficientes, orquestração de ferramentas e raciocínio visual, sendo adequado para agentes que inspecionam um resultado, revisam e decidem a próxima ação.
Pontos fortes
- Adequado para loops nos quais um agente executa código, lê a saída e revisa.
- A orquestração de ferramentas em várias chamadas é um foco declarado.
- O raciocínio visual sobre capturas de tela e diagramas funciona na mesma solicitação que o texto.
- JSON vinculado a esquema e cache oferecem suporte ao uso repetível em produção.
Quando usar outro modelo
- O Flash 3.7 e 3.8 são mais recentes e voltados para codificação mais complexa e execuções autônomas mais longas.
- Ele não possui um modo de pensamento dedicado, portanto, deliberações profundas são mais bem feitas em um modelo Pro.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoGemini APIPOST/v1beta/models/gemini-3.6-flash:generateContentFormato da API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preço
O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.
Especificação padrão
Por 1M Token- Preço oficial
- Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
- Preço da TokenLab
- Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075
- Desconto
- —
Leitura de cache
- Preço oficial
- $0.075
- Preço da TokenLab
- $0.075
- Desconto
- —
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço oficial
- $0.014/busca
- Preço da TokenLab
- $0.007/busca
- Desconto
- -50%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075 | Entrada $0.75 / Saída $3.75 / Leitura de cache $0.075 | — |
| Preços de cache de prompt | |||
| Leitura de cache | $0.075 | $0.075 | — |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.014/busca | $0.007/busca | -50% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 99,7%
- Requisições em 30 dias
- 100+
- Última atividade
- há 17 horas
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Gemini 3.6 Flash no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar gemini-3.6-flash com uma mensagem em /v1beta/models/gemini-3.6-flash:generateContent. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Visão
Loops de correção de código
Permitir que um agente execute testes, leia falhas, corrija arquivos e repita até que passem.
Inspeção de interface (UI)
Comparar uma captura de tela com uma especificação escrita e listar cada incompatibilidade de espaçamento, cor ou layout que um revisor deva corrigir.
Assistentes com uso intensivo de ferramentas
Coordenar chamadas de pesquisa, calendário e CRM dentro de uma única conversa, passando resultados de cada ferramenta para a próxima decisão.
Perguntas e respostas multimodais
Responder a perguntas que exigem tanto a imagem de um gráfico quanto o texto do relatório correspondente.
Exemplos de prompt
Execute os testes, leia a saída de falha e altere apenas a função que quebra o segundo teste.
Compare esta captura de tela com a especificação de design e liste cada incompatibilidade de espaçamento ou cor.
Verifique meu calendário e o CRM, depois redija uma resposta propondo dois horários de reunião.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Em que o Gemini 3.6 Flash é melhor?
Trabalho iterativo de agentes: loops de codificação, orquestração de ferramentas e raciocínio sobre imagens. Ele equilibra velocidade com capacidade multimodal, o que o torna um padrão razoável para agentes que não precisam do Flash mais recente.
Como ele é diferente do Flash 3.5?
O 3.6 é o lançamento posterior e é descrito em torno de loops de codificação e uso de ferramentas, enquanto o Flash 3.5 é a base para trabalho rotineiro de alto volume. Espere um melhor comportamento de agente do 3.6.
Devo migrar para o Flash 3.8?
Se você executa tarefas de software longas ou fluxos empresariais complexos, o Flash 3.8 é o que o Google posiciona para esses casos. Para agentes mais simples, o 3.6 pode ser suficiente; execute ambos em seus próprios rastreamentos.
Ele aceita imagens?
Sim. Imagens e texto podem ser combinados em uma única solicitação, e o modelo responde em texto ou em JSON que segue um esquema fornecido por você. Ele não gera imagens por conta própria.
Quanto custa o Gemini 3.6 Flash?
No TokenLab, Gemini 3.6 Flash custa Entrada $0.75 / Saída $3.75 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Gemini 3.6 Flash?
O Gemini 3.6 Flash aceita até 1.048.576 tokens de contexto e gera até 65.536 tokens por resposta.
Qual endpoint o Gemini 3.6 Flash deve usar?
Use https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent para Gemini 3.6 Flash. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Gemini 3.6 Flash suporta?
Gemini 3.6 Flash suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Gemini 3.6 Flash
Fontes
Revisado em 2 de out. de 2026