Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Google: Gemini 3.6 Flash

Gemini 3.6 Flash se centra en bucles de codificación eficientes, orquestación de herramientas y razonamiento visual. Es una opción útil para agentes que inspeccionan resultados repetidamente, revisan código y deciden la siguiente acción dentro de una tarea más amplia.
Comparar modelos
gemini-3.6-flash
DisponibleGoogleChatEntrada en caché 90% más barata
Entrada / Salida
$0.75 / $3.75
Contexto
1M
Lanzado
21 jul 2026
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de prompts

Sobre Gemini 3.6 Flash

Gemini 3.6 Flash es un modelo estable de la categoría Flash de Gemini que Google describe como un equilibrio entre velocidad y capacidad multimodal. Fue lanzado en julio de 2026, entre Flash 3.5 y Flash 3.7. Google lo enfoca en bucles de programación eficientes, orquestación de herramientas y razonamiento visual, por lo que es adecuado para agentes que inspeccionan un resultado, revisan y deciden la siguiente acción.

Puntos fuertes

  • Se ajusta a bucles en los que un agente ejecuta código, lee el resultado y revisa.
  • La orquestación de herramientas a través de varias llamadas es un enfoque declarado.
  • El razonamiento visual sobre capturas de pantalla y diagramas funciona en la misma solicitud que el texto.
  • El JSON vinculado a un esquema y el almacenamiento en caché admiten un uso repetible en producción.

Cuándo buscar otra opción

  • Flash 3.7 y 3.8 son más nuevos y están destinados a una programación más compleja y ejecuciones autónomas más largas.
  • No tiene un modo de pensamiento dedicado, por lo que la deliberación profunda es mejor realizarla en un modelo Pro.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoGemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    Formato de API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
Precio Verified
Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
Descuento
—
Precios de caché de prompt

Lectura de caché

Precio Official
$0.075
Precio Verified
$0.075
Descuento
—
Costos de herramientas

Se cobra por llamada, solo cuando el modelo utiliza la herramienta.

Búsqueda web

Precio Official
$0.014/búsqueda
Precio Verified
$0.007/búsqueda
Descuento
-50%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
99,7%
Solicitudes 30 días
100+
Última actividad
hace 3 horas

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Gemini 3.6 Flash en Console con un prompt listo para editar o enviar.

Ayúdame a probar gemini-3.6-flash con un mensaje breve en /v1beta/models/gemini-3.6-flash:generateContent. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Visión
  • Bucles de corrección de código

    Permitir que un agente ejecute pruebas, lea fallos, aplique parches a archivos y repita hasta que pasen.

  • Inspección de interfaz de usuario

    Comparar una captura de pantalla con una especificación escrita y enumerar cada discrepancia de espaciado, color o diseño que un revisor deba corregir.

  • Asistentes con uso intensivo de herramientas

    Coordinar llamadas de búsqueda, calendario y CRM dentro de una misma conversación, pasando los resultados de cada herramienta a la siguiente decisión.

  • Preguntas y respuestas multimodales

    Responder preguntas que requieran tanto una imagen de gráfico como el texto del informe circundante.

Ejemplos de prompts

Ejecuta las pruebas, lee el resultado del fallo y cambia solo la función que rompe la segunda prueba.

Compara esta captura de pantalla con la especificación de diseño y enumera cada discrepancia de espaciado o color.

Revisa mi calendario y el CRM, luego redacta una respuesta que proponga dos horarios de reunión.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿En qué destaca Gemini 3.6 Flash?

Trabajo iterativo de agentes: bucles de programación, orquestación de herramientas y razonamiento sobre imágenes. Equilibra la velocidad con la capacidad multimodal, lo que lo convierte en un valor predeterminado razonable para agentes que no necesitan la versión Flash más reciente.

¿En qué se diferencia de Flash 3.5?

3.6 es la versión posterior y se describe en torno a bucles de programación y uso de herramientas, mientras que Flash 3.5 es la base para el trabajo rutinario de alto volumen. Espere un mejor comportamiento del agente con 3.6.

¿Debería cambiar a Flash 3.8?

Si ejecuta tareas de software largas o flujos empresariales complejos, Flash 3.8 es el que Google posiciona para ellos. Para agentes más sencillos, 3.6 puede ser suficiente; ejecute ambos con sus propios seguimientos.

¿Acepta imágenes?

Sí. Las imágenes y el texto pueden combinarse en una sola solicitud, y el modelo responde en texto o en JSON que sigue un esquema que usted proporciona. No genera imágenes por sí mismo.

¿Cuánto cuesta Gemini 3.6 Flash?

En TokenLab, Gemini 3.6 Flash cuesta Entrada $0.75 / Salida $3.75 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.6 Flash?

Gemini 3.6 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.

¿Qué endpoint debe usar Gemini 3.6 Flash?

Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent para Gemini 3.6 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Gemini 3.6 Flash?

Gemini 3.6 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Gemini 3.6 Flash

Fuentes

Revisado el 2 oct 2026

Más de Gemini 3

Modelos relacionados