Google: Gemini 3.6 Flash
gemini-3.6-flash- Entrada / Salida
- $0.75 / $3.75
- Contexto
- 1M
- Lanzado
- 21 jul 2026
- Salida máxima
- 64K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de prompts
Sobre Gemini 3.6 Flash
Gemini 3.6 Flash es un modelo estable de la categoría Flash de Gemini que Google describe como un equilibrio entre velocidad y capacidad multimodal. Fue lanzado en julio de 2026, entre Flash 3.5 y Flash 3.7. Google lo enfoca en bucles de programación eficientes, orquestación de herramientas y razonamiento visual, por lo que es adecuado para agentes que inspeccionan un resultado, revisan y deciden la siguiente acción.
Puntos fuertes
- Se ajusta a bucles en los que un agente ejecuta código, lee el resultado y revisa.
- La orquestación de herramientas a través de varias llamadas es un enfoque declarado.
- El razonamiento visual sobre capturas de pantalla y diagramas funciona en la misma solicitud que el texto.
- El JSON vinculado a un esquema y el almacenamiento en caché admiten un uso repetible en producción.
Cuándo buscar otra opción
- Flash 3.7 y 3.8 son más nuevos y están destinados a una programación más compleja y ejecuciones autónomas más largas.
- No tiene un modo de pensamiento dedicado, por lo que la deliberación profunda es mejor realizarla en un modelo Pro.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoGemini APIPOST/v1beta/models/gemini-3.6-flash:generateContentFormato de API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Precios
El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
- Precio Verified
- Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
- Descuento
- —
Lectura de caché
- Precio Official
- $0.075
- Precio Verified
- $0.075
- Descuento
- —
Se cobra por llamada, solo cuando el modelo utiliza la herramienta.
Búsqueda web
- Precio Official
- $0.014/búsqueda
- Precio Verified
- $0.007/búsqueda
- Descuento
- -50%
| Precio OfficialPor 1M Token | Precio VerifiedPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075 | Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075 | — |
| Precios de caché de prompt | |||
| Lectura de caché | $0.075 | $0.075 | — |
| Costos de herramientasSe cobra por llamada, solo cuando el modelo utiliza la herramienta. | |||
| Búsqueda web | $0.014/búsqueda | $0.007/búsqueda | -50% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 99,7%
- Solicitudes 30 días
- 100+
- Última actividad
- hace 3 horas
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Gemini 3.6 Flash en Console con un prompt listo para editar o enviar.
Ayúdame a probar gemini-3.6-flash con un mensaje breve en /v1beta/models/gemini-3.6-flash:generateContent. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Visión
Bucles de corrección de código
Permitir que un agente ejecute pruebas, lea fallos, aplique parches a archivos y repita hasta que pasen.
Inspección de interfaz de usuario
Comparar una captura de pantalla con una especificación escrita y enumerar cada discrepancia de espaciado, color o diseño que un revisor deba corregir.
Asistentes con uso intensivo de herramientas
Coordinar llamadas de búsqueda, calendario y CRM dentro de una misma conversación, pasando los resultados de cada herramienta a la siguiente decisión.
Preguntas y respuestas multimodales
Responder preguntas que requieran tanto una imagen de gráfico como el texto del informe circundante.
Ejemplos de prompts
Ejecuta las pruebas, lee el resultado del fallo y cambia solo la función que rompe la segunda prueba.
Compara esta captura de pantalla con la especificación de diseño y enumera cada discrepancia de espaciado o color.
Revisa mi calendario y el CRM, luego redacta una respuesta que proponga dos horarios de reunión.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿En qué destaca Gemini 3.6 Flash?
Trabajo iterativo de agentes: bucles de programación, orquestación de herramientas y razonamiento sobre imágenes. Equilibra la velocidad con la capacidad multimodal, lo que lo convierte en un valor predeterminado razonable para agentes que no necesitan la versión Flash más reciente.
¿En qué se diferencia de Flash 3.5?
3.6 es la versión posterior y se describe en torno a bucles de programación y uso de herramientas, mientras que Flash 3.5 es la base para el trabajo rutinario de alto volumen. Espere un mejor comportamiento del agente con 3.6.
¿Debería cambiar a Flash 3.8?
Si ejecuta tareas de software largas o flujos empresariales complejos, Flash 3.8 es el que Google posiciona para ellos. Para agentes más sencillos, 3.6 puede ser suficiente; ejecute ambos con sus propios seguimientos.
¿Acepta imágenes?
Sí. Las imágenes y el texto pueden combinarse en una sola solicitud, y el modelo responde en texto o en JSON que sigue un esquema que usted proporciona. No genera imágenes por sí mismo.
¿Cuánto cuesta Gemini 3.6 Flash?
En TokenLab, Gemini 3.6 Flash cuesta Entrada $0.75 / Salida $3.75 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.6 Flash?
Gemini 3.6 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.
¿Qué endpoint debe usar Gemini 3.6 Flash?
Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent para Gemini 3.6 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Gemini 3.6 Flash?
Gemini 3.6 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Gemini 3.6 Flash
Fuentes
Revisado el 2 oct 2026