Google: Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite- Entrada / Salida-50%
- $0.30 / $2.50$0.15 / $1.25
- Contexto
- 1M
- Lanzado
- 21 jul 2026
- Salida máxima
- 64K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de prompts
Sobre Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite es el modelo más rápido y rentable de Google de la generación 3.5, lanzado en julio de 2026. Está dirigido a trabajos de alto volumen donde los tiempos de respuesta cortos son importantes: procesamiento de documentos, extracción y pequeñas tareas repetitivas de agentes. Lee texto e imágenes, llama a herramientas, devuelve JSON vinculado a esquemas y almacena contexto en caché; Google recomienda ahora este modelo para nuevos proyectos.
Puntos fuertes
- Diseñado para tiempos de respuesta cortos en trabajos que se repiten miles de veces.
- Maneja texto e imágenes conjuntamente para el procesamiento de documentos y capturas de pantalla.
- El JSON vinculado a esquemas mantiene consistente la salida de extracción.
- La llamada a funciones le permite ejecutar pequeños pasos de agente, como búsquedas o enrutamiento.
Cuándo buscar otra opción
- Las sesiones de codificación largas y los flujos de trabajo empresariales complejos corresponden a 3.8 Flash o 3.1 Pro.
- Pasará por alto detalles que un modelo Flash más completo detectaría en documentos densos o ambiguos.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoGemini APIPOST/v1beta/models/gemini-3.5-flash-lite:generateContentFormato de API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Precios
El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $0.30 / Salida $2.50 / Lectura de caché $0.03
- Precio de TokenLab
- Entrada $0.15 / Salida $1.25 / Lectura de caché $0.015
- Descuento
- -50%
Lectura de caché
- Precio Official
- $0.03
- Precio de TokenLab
- $0.015
- Descuento
- -50%
| Precio OfficialPor 1M Token | Precio de TokenLabPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $0.30 / Salida $2.50 / Lectura de caché $0.03 | Entrada $0.15 / Salida $1.25 / Lectura de caché $0.015 | -50% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.03 | $0.015 | -50% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 99,7%
- Latencia mediana 7 días
- 1,9 sn=346
- Latencia P95 7 días
- 7 sn=346
- Solicitudes 30 días
- 100+
- Última actividad
- hace 19 horas
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Gemini 3.5 Flash-Lite en Console con un prompt listo para editar o enviar.
Ayúdame a probar gemini-3.5-flash-lite con un mensaje breve en /v1beta/models/gemini-3.5-flash-lite:generateContent. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Visión
Flujos de trabajo de documentos
Convierte contratos, facturas e informes en campos estructurados a escala, escribiendo un registro JSON validado por cada archivo entrante.
Triaje de colas
Clasifica los tickets o mensajes entrantes por tema y urgencia antes de que los vea un humano o un modelo más grande.
Agentes pequeños
Ejecuta trabajos específicos de herramientas en bucle, como búsquedas de pedidos o cambios de calendario, donde cada paso es pequeño y el bucle se repite con frecuencia.
Verificaciones visuales
Confirma que las fotos subidas cumplen reglas simples, como una etiqueta visible o la orientación correcta.
Ejemplos de prompts
Extrae cada partida de esta factura como JSON con descripción, cantidad y monto unitario.
Califica la urgencia de este ticket como baja, media o alta y proporciona la frase única que lo justifica.
Comprueba si esta foto de producto muestra claramente la etiqueta del envase; responde sí o no y explica por qué.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Para qué sirve Gemini 3.5 Flash-Lite?
Trabajo rápido, repetitivo y simple: extracción, clasificación, enrutamiento y comprobaciones multimodales ligeras. Es el extremo económico de la familia 3.5, diseñado para priorizar el tiempo de respuesta sobre la profundidad.
¿Es más nuevo que Gemini 3.1 Flash-Lite?
Sí. Es la generación posterior y Google lo enumera como la opción ligera recomendada para nuevos proyectos. El antiguo 3.1 Flash-Lite sigue estando disponible para integraciones existentes.
¿Puede leer imágenes?
Sí, las imágenes pueden acompañar al texto en una solicitud, y la respuesta se devuelve como texto plano o como JSON estructurado, lo que resulta adecuado para comprobaciones de fotos y extracción de documentos escaneados.
¿Cuándo es demasiado pequeño?
Cuando la tarea requiere un razonamiento sostenido, un análisis cuidadoso de documentos largos o un trabajo de codificación de varias horas. En esos casos, utiliza Gemini 3.8 Flash o 3.1 Pro.
¿Cuánto cuesta Gemini 3.5 Flash-Lite?
En TokenLab, Gemini 3.5 Flash-Lite cuesta Entrada $0.15 / Salida $1.25 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.
¿Qué endpoint debe usar Gemini 3.5 Flash-Lite?
Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent para Gemini 3.5 Flash-Lite. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Gemini 3.5 Flash-Lite
Fuentes
Revisado el 2 oct 2026