Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite se dirige a trabajos de alto volumen con tiempos de respuesta cortos. Considérelo para el procesamiento de documentos, extracción y tareas de agentes más pequeñas que se ejecutan repetidamente y requieren un manejo eficiente de texto y entradas visuales.
Comparar modelos
gemini-3.5-flash-lite
DisponibleGoogleChatEntrada en caché 90% más barata
Entrada / Salida-50%
$0.30 / $2.50$0.15 / $1.25
Contexto
1M
Lanzado
21 jul 2026
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de prompts

Sobre Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite es el modelo más rápido y rentable de Google de la generación 3.5, lanzado en julio de 2026. Está dirigido a trabajos de alto volumen donde los tiempos de respuesta cortos son importantes: procesamiento de documentos, extracción y pequeñas tareas repetitivas de agentes. Lee texto e imágenes, llama a herramientas, devuelve JSON vinculado a esquemas y almacena contexto en caché; Google recomienda ahora este modelo para nuevos proyectos.

Puntos fuertes

  • Diseñado para tiempos de respuesta cortos en trabajos que se repiten miles de veces.
  • Maneja texto e imágenes conjuntamente para el procesamiento de documentos y capturas de pantalla.
  • El JSON vinculado a esquemas mantiene consistente la salida de extracción.
  • La llamada a funciones le permite ejecutar pequeños pasos de agente, como búsquedas o enrutamiento.

Cuándo buscar otra opción

  • Las sesiones de codificación largas y los flujos de trabajo empresariales complejos corresponden a 3.8 Flash o 3.1 Pro.
  • Pasará por alto detalles que un modelo Flash más completo detectaría en documentos densos o ambiguos.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoGemini API
    POST/v1beta/models/gemini-3.5-flash-lite:generateContent
    Formato de API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Precios

El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $0.30 / Salida $2.50 / Lectura de caché $0.03
Precio de TokenLab
Entrada $0.15 / Salida $1.25 / Lectura de caché $0.015
Descuento
-50%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.03
Precio de TokenLab
$0.015
Descuento
-50%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
99,7%
Latencia mediana 7 días
1,9 sn=346
Latencia P95 7 días
7 sn=346
Solicitudes 30 días
100+
Última actividad
hace 19 horas

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Gemini 3.5 Flash-Lite en Console con un prompt listo para editar o enviar.

Ayúdame a probar gemini-3.5-flash-lite con un mensaje breve en /v1beta/models/gemini-3.5-flash-lite:generateContent. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Visión
  • Flujos de trabajo de documentos

    Convierte contratos, facturas e informes en campos estructurados a escala, escribiendo un registro JSON validado por cada archivo entrante.

  • Triaje de colas

    Clasifica los tickets o mensajes entrantes por tema y urgencia antes de que los vea un humano o un modelo más grande.

  • Agentes pequeños

    Ejecuta trabajos específicos de herramientas en bucle, como búsquedas de pedidos o cambios de calendario, donde cada paso es pequeño y el bucle se repite con frecuencia.

  • Verificaciones visuales

    Confirma que las fotos subidas cumplen reglas simples, como una etiqueta visible o la orientación correcta.

Ejemplos de prompts

Extrae cada partida de esta factura como JSON con descripción, cantidad y monto unitario.

Califica la urgencia de este ticket como baja, media o alta y proporciona la frase única que lo justifica.

Comprueba si esta foto de producto muestra claramente la etiqueta del envase; responde sí o no y explica por qué.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Para qué sirve Gemini 3.5 Flash-Lite?

Trabajo rápido, repetitivo y simple: extracción, clasificación, enrutamiento y comprobaciones multimodales ligeras. Es el extremo económico de la familia 3.5, diseñado para priorizar el tiempo de respuesta sobre la profundidad.

¿Es más nuevo que Gemini 3.1 Flash-Lite?

Sí. Es la generación posterior y Google lo enumera como la opción ligera recomendada para nuevos proyectos. El antiguo 3.1 Flash-Lite sigue estando disponible para integraciones existentes.

¿Puede leer imágenes?

Sí, las imágenes pueden acompañar al texto en una solicitud, y la respuesta se devuelve como texto plano o como JSON estructurado, lo que resulta adecuado para comprobaciones de fotos y extracción de documentos escaneados.

¿Cuándo es demasiado pequeño?

Cuando la tarea requiere un razonamiento sostenido, un análisis cuidadoso de documentos largos o un trabajo de codificación de varias horas. En esos casos, utiliza Gemini 3.8 Flash o 3.1 Pro.

¿Cuánto cuesta Gemini 3.5 Flash-Lite?

En TokenLab, Gemini 3.5 Flash-Lite cuesta Entrada $0.15 / Salida $1.25 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.

¿Qué endpoint debe usar Gemini 3.5 Flash-Lite?

Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent para Gemini 3.5 Flash-Lite. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Gemini 3.5 Flash-Lite

Fuentes

Revisado el 2 oct 2026

Más de Gemini 3

Modelos relacionados