Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Google: Gemini 3.5 Flash

Gemini 3.5 Flash está diseñado para la codificación sostenida y el trabajo agentico. Su contexto largo y su capacidad de llamada a herramientas son adecuados para asistentes que deben llevar a cabo una tarea en varios pasos mientras conservan documentos, código y decisiones previas.
Comparar modelos
gemini-3.5-flash
DisponibleGoogleChatEntrada en caché 90% más barata
Entrada / Salida-50%
$1.50 / $9.00$0.75 / $4.50
Contexto
1M
Lanzado
19 may 2026
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Sobre Gemini 3.5 Flash

Gemini 3.5 Flash es un modelo estable de la categoría Flash de Google, descrito por la compañía como la base para la velocidad y el rendimiento fundamental en cargas de trabajo rutinarias de alto rendimiento. Lee texto e imágenes, llama a herramientas, devuelve JSON vinculado a un esquema y admite almacenamiento en caché. Se sitúa entre Flash-Lite 3.5 y las versiones posteriores 3.6, 3.7 y 3.8 de Flash.

Puntos fuertes

  • Un modelo Flash estable de propósito general para chat rutinario, extracción y resumen a gran volumen.
  • La llamada a herramientas permite asistentes que ejecutan una tarea a través de varios pasos.
  • La entrada de imágenes le permite manejar capturas de pantalla, escaneos y gráficos sin necesidad de un modelo de visión independiente.
  • El JSON vinculado a un esquema y el almacenamiento en caché de contexto son adecuados para llamadas repetidas en procesos automatizados.

Cuándo buscar otra opción

  • Los modelos Flash posteriores 3.6, 3.7 y 3.8 son más sólidos en tareas de programación y agentes.
  • No tiene un modo de pensamiento dedicado, por lo que el razonamiento complejo de varios pasos es mejor enviarlo a otro lugar.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoGemini API
    POST/v1beta/models/gemini-3.5-flash:generateContent
    Formato de API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $1.50 / Salida $9.00 / Lectura de caché $0.15
Precio Verified
Entrada $0.75 / Salida $4.50 / Lectura de caché $0.075
Descuento
-50%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.15
Precio Verified
$0.075
Descuento
-50%
Costos de herramientas

Se cobra por llamada, solo cuando el modelo utiliza la herramienta.

Búsqueda web

Precio Official
$0.014/búsqueda
Precio Verified
$0.007/búsqueda
Descuento
-50%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
95,0%
Solicitudes 30 días
1K+
Última actividad
hace 1 hora

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Gemini 3.5 Flash en Console con un prompt listo para editar o enviar.

Ayúdame a probar gemini-3.5-flash con un mensaje breve en /v1beta/models/gemini-3.5-flash:generateContent. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Razonamiento
  • Visión
  • Chat orientado al cliente

    Responder preguntas sobre productos con una base de conocimientos almacenada en caché en el prefijo del prompt.

  • Resumen por lotes

    Resumir transcripciones de llamadas o tickets y generar un resumen en JSON fijo por cada elemento.

  • Lectura de formularios y documentos

    Extraer campos de formularios escaneados y notas de entrega en registros estructurados que un sistema posterior pueda cargar directamente.

  • Ayuda de programación de nivel inicial

    Explicar código, escribir funciones pequeñas y redactar pruebas unitarias donde la profundidad no sea crítica.

Ejemplos de prompts

Resume esta transcripción de soporte en tres puntos y establece 'resuelto' como verdadero o falso.

Lee esta nota de entrega escaneada y devuelve el número de pedido, los artículos y el estado de la firma como JSON.

Escribe una función de Python que analice fechas ISO a partir de cadenas desordenadas, además de cinco casos de prueba.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Qué es Gemini 3.5 Flash?

Un modelo Gemini estable de la categoría Flash orientado a tareas rutinarias de alto rendimiento. Acepta texto e imágenes, utiliza herramientas y produce resultados estructurados, con un enfoque en la velocidad constante sobre la profundidad máxima.

¿Cómo se compara con Gemini 3.5 Flash-Lite?

Flash-Lite es el modelo 3.5 más rápido y económico de Google; Flash es el modelo más completo para tareas que requieren mayor atención. Elija Lite para etiquetado y extracción, y Flash para conversaciones y resultados más largos.

¿Es bueno para agentes de programación?

Puede manejar tareas de programación pequeñas, pero los modelos Flash 3.7 y 3.8 posteriores de Google son los destinados a la programación compleja y agentes de largo alcance. Use 3.5 Flash cuando el trabajo sea sencillo y el volumen sea alto.

¿Admite imágenes y almacenamiento en caché?

Sí a ambos. Las imágenes pueden incluirse junto al texto en una sola solicitud, y el almacenamiento en caché de contexto reutiliza un prefijo compartido largo en muchas solicitudes, como un conjunto de instrucciones fijo.

¿Cuánto cuesta Gemini 3.5 Flash?

En TokenLab, Gemini 3.5 Flash cuesta Entrada $0.75 / Salida $4.50 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.5 Flash?

Gemini 3.5 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.

¿Qué endpoint debe usar Gemini 3.5 Flash?

Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent para Gemini 3.5 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Gemini 3.5 Flash?

Gemini 3.5 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Gemini 3.5 Flash

Guías con Gemini 3.5 Flash

Fuentes

Revisado el 2 oct 2026

Más de Gemini 3

Modelos relacionados