Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Google: Gemini 3.7 Flash

Modelo Gemini de alta eficiencia para flujos de trabajo agenticos, codificación y razonamiento multimodal
Comparar modelos
gemini-3.7-flash
DisponibleGoogleChatEntrada en caché 90% más barata
Entrada / Salida-50%
$0.75 / $3.75$0.375 / $1.88
Contexto
1M
Lanzado
13 ago 2026
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de prompts

Sobre Gemini 3.7 Flash

Gemini 3.7 Flash es un modelo estable de la categoría Flash de Google, lanzado en agosto de 2026, que Google describe como diseñado para programación compleja, flujos de trabajo de agentes y ejecución fiable de múltiples pasos. Lee texto e imágenes, admite razonamiento (thinking), llama a herramientas, devuelve JSON vinculado a esquemas y almacena contexto en caché. Está un nivel por encima de 3.6 Flash y un nivel por debajo de 3.8 Flash.

Puntos fuertes

  • El razonamiento puede ejecutarse antes de la respuesta, lo que ayuda en tareas de programación y de múltiples pasos.
  • La ejecución fiable de múltiples pasos es el objetivo de diseño declarado, útil cuando un agente no debe perder el hilo de su progreso.
  • La llamada a herramientas y el JSON vinculado a esquemas facilitan la integración de los resultados en otros sistemas.
  • La entrada de imágenes procesa capturas de pantalla, diagramas y documentos escaneados.

Cuándo buscar otra opción

  • Gemini 3.8 Flash es el modelo más reciente que Google presenta como su categoría Flash más capaz.
  • El razonamiento añade latencia, por lo que las consultas simples se gestionan mejor con Flash-Lite.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    Formato de API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Promotional Standard

Por 1M Token
Precio Official
Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
Precio Verified
Entrada $0.375 / Salida $1.88 / Lectura de caché $0.0375
Descuento
-50%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.075
Precio Verified
$0.0375
Descuento
-50%
Costos de herramientas

Se cobra por llamada, solo cuando el modelo utiliza la herramienta.

Búsqueda web

Precio Official
$0.014/búsqueda
Precio Verified
$0.007/búsqueda
Descuento
-50%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
99,8%
Latencia mediana 7 días
13,6 sn=271
Latencia P95 7 días
53 sn=271
Solicitudes 30 días
1K+
Última actividad
hace 19 horas

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Gemini 3.7 Flash en Console con un prompt listo para editar o enviar.

Ayúdame a probar gemini-3.7-flash con un mensaje breve en /v1beta/models/gemini-3.7-flash:generateContent. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Visión
  • Implementación de funciones

    Hacer que un agente lea un ticket, edite varios archivos y ejecute pruebas.

  • Automatización de flujos de trabajo

    Encadenar aprobaciones, consultas y notificaciones donde cada paso depende del anterior.

  • Revisión de código

    Leer un diff, marcar cambios arriesgados y explicar cada hallazgo para que un revisor humano pueda decidir rápidamente qué aceptar.

  • Limpieza de datos

    Razonar sobre registros inconsistentes y proponer reglas de normalización antes de aplicarlas, para que la limpieza pueda ser auditada previamente.

Ejemplos de prompts

Lee este ticket y los archivos vinculados, implementa el cambio y enumera las pruebas que has ejecutado.

Revisa este diff en busca de errores de concurrencia y clasifica los hallazgos por gravedad.

Estos dos registros de cliente parecen duplicados. Explica qué campos entran en conflicto y qué regla los fusionaría de forma segura.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Para qué está diseñado Gemini 3.7 Flash?

Programación compleja, flujos de trabajo de agentes y ejecución de múltiples pasos que debe mantenerse fiable desde el primer paso hasta el último. Es un modelo Flash con capacidad de razonamiento y soporte para herramientas e imágenes.

¿Admite razonamiento?

Sí. Puede razonar antes de responder, lo que mejora los resultados en código y planificación. Mantén ese esfuerzo bajo en turnos interactivos cortos para que las respuestas sean rápidas.

¿En qué se diferencia de 3.6 Flash?

3.7 Flash es el modelo posterior y añade razonamiento, con un mayor énfasis en ejecuciones fiables de múltiples pasos. 3.6 Flash se centra en bucles de programación y razonamiento visual sin razonamiento previo.

¿Es 3.8 Flash una mejor opción?

A menudo, para ingeniería de software de largo alcance. 3.7 Flash sigue siendo una opción sólida cuando ya has ajustado los prompts para él y sus resultados cumplen con tus estándares.

¿Cuánto cuesta Gemini 3.7 Flash?

En TokenLab, Gemini 3.7 Flash cuesta Entrada $0.375 / Salida $1.88 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.7 Flash?

Gemini 3.7 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.

¿Qué endpoint debe usar Gemini 3.7 Flash?

Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent para Gemini 3.7 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Gemini 3.7 Flash?

Gemini 3.7 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Gemini 3.7 Flash

Fuentes

Revisado el 2 oct 2026

Más de Gemini 3

Modelos relacionados