Google: Gemini 3.5 Flash
gemini-3.5-flash- Entrada / Salida-50%
- $1.50 / $9.00$0.75 / $4.50
- Contexto
- 1M
- Lanzado
- 19 may 2026
- Salida máxima
- 64K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de promptsRazonamiento
Sobre Gemini 3.5 Flash
Gemini 3.5 Flash es un modelo estable de la categoría Flash de Google, descrito por la compañía como la base para la velocidad y el rendimiento fundamental en cargas de trabajo rutinarias de alto rendimiento. Lee texto e imágenes, llama a herramientas, devuelve JSON vinculado a un esquema y admite almacenamiento en caché. Se sitúa entre Flash-Lite 3.5 y las versiones posteriores 3.6, 3.7 y 3.8 de Flash.
Puntos fuertes
- Un modelo Flash estable de propósito general para chat rutinario, extracción y resumen a gran volumen.
- La llamada a herramientas permite asistentes que ejecutan una tarea a través de varios pasos.
- La entrada de imágenes le permite manejar capturas de pantalla, escaneos y gráficos sin necesidad de un modelo de visión independiente.
- El JSON vinculado a un esquema y el almacenamiento en caché de contexto son adecuados para llamadas repetidas en procesos automatizados.
Cuándo buscar otra opción
- Los modelos Flash posteriores 3.6, 3.7 y 3.8 son más sólidos en tareas de programación y agentes.
- No tiene un modo de pensamiento dedicado, por lo que el razonamiento complejo de varios pasos es mejor enviarlo a otro lugar.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoGemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentFormato de API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Precios
El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $1.50 / Salida $9.00 / Lectura de caché $0.15
- Precio Verified
- Entrada $0.75 / Salida $4.50 / Lectura de caché $0.075
- Descuento
- -50%
Lectura de caché
- Precio Official
- $0.15
- Precio Verified
- $0.075
- Descuento
- -50%
Se cobra por llamada, solo cuando el modelo utiliza la herramienta.
Búsqueda web
- Precio Official
- $0.014/búsqueda
- Precio Verified
- $0.007/búsqueda
- Descuento
- -50%
| Precio OfficialPor 1M Token | Precio VerifiedPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $1.50 / Salida $9.00 / Lectura de caché $0.15 | Entrada $0.75 / Salida $4.50 / Lectura de caché $0.075 | -50% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.15 | $0.075 | -50% |
| Costos de herramientasSe cobra por llamada, solo cuando el modelo utiliza la herramienta. | |||
| Búsqueda web | $0.014/búsqueda | $0.007/búsqueda | -50% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 95,0%
- Solicitudes 30 días
- 1K+
- Última actividad
- hace 1 hora
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Gemini 3.5 Flash en Console con un prompt listo para editar o enviar.
Ayúdame a probar gemini-3.5-flash con un mensaje breve en /v1beta/models/gemini-3.5-flash:generateContent. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Razonamiento
- Visión
Chat orientado al cliente
Responder preguntas sobre productos con una base de conocimientos almacenada en caché en el prefijo del prompt.
Resumen por lotes
Resumir transcripciones de llamadas o tickets y generar un resumen en JSON fijo por cada elemento.
Lectura de formularios y documentos
Extraer campos de formularios escaneados y notas de entrega en registros estructurados que un sistema posterior pueda cargar directamente.
Ayuda de programación de nivel inicial
Explicar código, escribir funciones pequeñas y redactar pruebas unitarias donde la profundidad no sea crítica.
Ejemplos de prompts
Resume esta transcripción de soporte en tres puntos y establece 'resuelto' como verdadero o falso.
Lee esta nota de entrega escaneada y devuelve el número de pedido, los artículos y el estado de la firma como JSON.
Escribe una función de Python que analice fechas ISO a partir de cadenas desordenadas, además de cinco casos de prueba.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Qué es Gemini 3.5 Flash?
Un modelo Gemini estable de la categoría Flash orientado a tareas rutinarias de alto rendimiento. Acepta texto e imágenes, utiliza herramientas y produce resultados estructurados, con un enfoque en la velocidad constante sobre la profundidad máxima.
¿Cómo se compara con Gemini 3.5 Flash-Lite?
Flash-Lite es el modelo 3.5 más rápido y económico de Google; Flash es el modelo más completo para tareas que requieren mayor atención. Elija Lite para etiquetado y extracción, y Flash para conversaciones y resultados más largos.
¿Es bueno para agentes de programación?
Puede manejar tareas de programación pequeñas, pero los modelos Flash 3.7 y 3.8 posteriores de Google son los destinados a la programación compleja y agentes de largo alcance. Use 3.5 Flash cuando el trabajo sea sencillo y el volumen sea alto.
¿Admite imágenes y almacenamiento en caché?
Sí a ambos. Las imágenes pueden incluirse junto al texto en una sola solicitud, y el almacenamiento en caché de contexto reutiliza un prefijo compartido largo en muchas solicitudes, como un conjunto de instrucciones fijo.
¿Cuánto cuesta Gemini 3.5 Flash?
En TokenLab, Gemini 3.5 Flash cuesta Entrada $0.75 / Salida $4.50 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.5 Flash?
Gemini 3.5 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.
¿Qué endpoint debe usar Gemini 3.5 Flash?
Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent para Gemini 3.5 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Gemini 3.5 Flash?
Gemini 3.5 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Gemini 3.5 Flash
Guías con Gemini 3.5 Flash
Fuentes
Revisado el 2 oct 2026