Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite- Entrada / Saída-50%
- $0.10 / $0.40$0.05 / $0.20
- Contexto
- 1M
- Saída máxima
- 64K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
chat_completionGemini APIPOST/v1beta/models/gemini-2.5-flash-lite:generateContentFormato da API:curl "https://api.tokenlab.sh/v1beta/models/gemini-2.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preço
O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.
Especificação padrão
Por 1M Token- Preço oficial
- Entrada $0.10 / Saída $0.40 / Leitura de cache $0.01
- Preço da TokenLab
- Entrada $0.05 / Saída $0.20 / Leitura de cache $0.005
- Desconto
- -50%
Leitura de cache
- Preço oficial
- $0.01
- Preço da TokenLab
- $0.005
- Desconto
- -50%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $0.10 / Saída $0.40 / Leitura de cache $0.01 | Entrada $0.05 / Saída $0.20 / Leitura de cache $0.005 | -50% |
| Leitura de cache | $0.01 | $0.005 | -50% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horasAinda sem dados
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra gemini-2.5-flash-lite no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar gemini-2.5-flash-lite com uma mensagem em /v1beta/models/gemini-2.5-flash-lite:generateContent. Exiba a resposta, latência e custo.
Casos de uso
Indicado paraRaciocínio
Raciocínio multi-etapas, análise e fluxos de pesquisa
Visão
Ler imagens, parsear documentos e responder perguntas visuais
Agentes e ferramentas
Gerencie raciocínio, triagem de suporte, chamadas de ferramentas e tarefas complexas.
Programação
Crie, revise ou depure código diretamente nas suas ferramentas.
Assistentes de conhecimento
Desenvolva chat, busca e recuperação com preços e capacidades transparentes.
Comparação direta
Compare qualidade de resposta, latência e preço lado a lado.
Exemplos de prompt
Escreva uma resposta de suporte concisa e liste as premissas por trás.
Revise este design de API e aponte os três principais riscos de integração.
Transforme um changelog longo em release notes legíveis para quem não é dev.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Quanto custa o gemini-2.5-flash-lite?
No TokenLab, gemini-2.5-flash-lite custa Entrada $0.05 / Saída $0.20 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Para que o gemini-2.5-flash-lite é melhor?
gemini-2.5-flash-lite suporta Modo JSON, Cache de prompts, Raciocínio. Você pode abri-lo diretamente no Create.
Como posso testar o gemini-2.5-flash-lite?
Abra gemini-2.5-flash-lite no Create para testar um exemplo preparado para /v1beta/models/gemini-2.5-flash-lite:generateContent.
Qual endpoint o gemini-2.5-flash-lite deve usar?
Use https://api.tokenlab.sh/v1beta/models/gemini-2.5-flash-lite:generateContent para gemini-2.5-flash-lite. O exemplo de requisição abaixo mostra o formato de código correspondente.
Posso testar o gemini-2.5-flash-lite antes de integrar?
Sim. Abrir o Console inicia um rascunho pronto para gemini-2.5-flash-lite e mantém seu prompt após o login, sem perder contexto.
Quais operações o gemini-2.5-flash-lite suporta?
gemini-2.5-flash-lite suporta chat_completion. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.