Google: Gemini 3.7 Flash
gemini-3.7-flash- Entrada / Salida-50%
- $0.75 / $3.75$0.375 / $1.88
- Contexto
- 1M
- Lanzado
- 13 ago 2026
- Salida máxima
- 64K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de prompts
Sobre Gemini 3.7 Flash
Gemini 3.7 Flash es un modelo estable de la categoría Flash de Google, lanzado en agosto de 2026, que Google describe como diseñado para programación compleja, flujos de trabajo de agentes y ejecución fiable de múltiples pasos. Lee texto e imágenes, admite razonamiento (thinking), llama a herramientas, devuelve JSON vinculado a esquemas y almacena contexto en caché. Está un nivel por encima de 3.6 Flash y un nivel por debajo de 3.8 Flash.
Puntos fuertes
- El razonamiento puede ejecutarse antes de la respuesta, lo que ayuda en tareas de programación y de múltiples pasos.
- La ejecución fiable de múltiples pasos es el objetivo de diseño declarado, útil cuando un agente no debe perder el hilo de su progreso.
- La llamada a herramientas y el JSON vinculado a esquemas facilitan la integración de los resultados en otros sistemas.
- La entrada de imágenes procesa capturas de pantalla, diagramas y documentos escaneados.
Cuándo buscar otra opción
- Gemini 3.8 Flash es el modelo más reciente que Google presenta como su categoría Flash más capaz.
- El razonamiento añade latencia, por lo que las consultas simples se gestionan mejor con Flash-Lite.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoGemini APIPOST/v1beta/models/gemini-3.7-flash:generateContentFormato de API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Precios
El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.
Promotional Standard
Por 1M Token- Precio Official
- Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075
- Precio Verified
- Entrada $0.375 / Salida $1.88 / Lectura de caché $0.0375
- Descuento
- -50%
Lectura de caché
- Precio Official
- $0.075
- Precio Verified
- $0.0375
- Descuento
- -50%
Se cobra por llamada, solo cuando el modelo utiliza la herramienta.
Búsqueda web
- Precio Official
- $0.014/búsqueda
- Precio Verified
- $0.007/búsqueda
- Descuento
- -50%
| Precio OfficialPor 1M Token | Precio VerifiedPor 1M Token | Descuento | |
|---|---|---|---|
| Promotional Standard | Entrada $0.75 / Salida $3.75 / Lectura de caché $0.075 | Entrada $0.375 / Salida $1.88 / Lectura de caché $0.0375 | -50% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.075 | $0.0375 | -50% |
| Costos de herramientasSe cobra por llamada, solo cuando el modelo utiliza la herramienta. | |||
| Búsqueda web | $0.014/búsqueda | $0.007/búsqueda | -50% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 99,8%
- Latencia mediana 7 días
- 13,6 sn=271
- Latencia P95 7 días
- 53 sn=271
- Solicitudes 30 días
- 1K+
- Última actividad
- hace 19 horas
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Gemini 3.7 Flash en Console con un prompt listo para editar o enviar.
Ayúdame a probar gemini-3.7-flash con un mensaje breve en /v1beta/models/gemini-3.7-flash:generateContent. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Visión
Implementación de funciones
Hacer que un agente lea un ticket, edite varios archivos y ejecute pruebas.
Automatización de flujos de trabajo
Encadenar aprobaciones, consultas y notificaciones donde cada paso depende del anterior.
Revisión de código
Leer un diff, marcar cambios arriesgados y explicar cada hallazgo para que un revisor humano pueda decidir rápidamente qué aceptar.
Limpieza de datos
Razonar sobre registros inconsistentes y proponer reglas de normalización antes de aplicarlas, para que la limpieza pueda ser auditada previamente.
Ejemplos de prompts
Lee este ticket y los archivos vinculados, implementa el cambio y enumera las pruebas que has ejecutado.
Revisa este diff en busca de errores de concurrencia y clasifica los hallazgos por gravedad.
Estos dos registros de cliente parecen duplicados. Explica qué campos entran en conflicto y qué regla los fusionaría de forma segura.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Para qué está diseñado Gemini 3.7 Flash?
Programación compleja, flujos de trabajo de agentes y ejecución de múltiples pasos que debe mantenerse fiable desde el primer paso hasta el último. Es un modelo Flash con capacidad de razonamiento y soporte para herramientas e imágenes.
¿Admite razonamiento?
Sí. Puede razonar antes de responder, lo que mejora los resultados en código y planificación. Mantén ese esfuerzo bajo en turnos interactivos cortos para que las respuestas sean rápidas.
¿En qué se diferencia de 3.6 Flash?
3.7 Flash es el modelo posterior y añade razonamiento, con un mayor énfasis en ejecuciones fiables de múltiples pasos. 3.6 Flash se centra en bucles de programación y razonamiento visual sin razonamiento previo.
¿Es 3.8 Flash una mejor opción?
A menudo, para ingeniería de software de largo alcance. 3.7 Flash sigue siendo una opción sólida cuando ya has ajustado los prompts para él y sus resultados cumplen con tus estándares.
¿Cuánto cuesta Gemini 3.7 Flash?
En TokenLab, Gemini 3.7 Flash cuesta Entrada $0.375 / Salida $1.88 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Gemini 3.7 Flash?
Gemini 3.7 Flash admite hasta 1.048.576 tokens de contexto y genera hasta 65.536 tokens por respuesta.
¿Qué endpoint debe usar Gemini 3.7 Flash?
Utiliza https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent para Gemini 3.7 Flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Gemini 3.7 Flash?
Gemini 3.7 Flash admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Gemini 3.7 Flash
Fuentes
Revisado el 2 oct 2026