Google: gemini-2.5-flash

Precio, rendimiento, capacidades y una solicitud lista para usar con gemini-2.5-flash.
Comparar modelos
gemini-2.5-flash
DisponibleGoogleChatEntrada en caché 90% más barata
Entrada / Salida-50%
$0.30 / $2.50$0.15 / $1.25
Contexto
1M
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    chat_completionGemini API
    POST/v1beta/models/gemini-2.5-flash:generateContent
    Formato de API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-2.5-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $0.30 / Salida $2.50 / Lectura de caché $0.03
Precio de TokenLab
Entrada $0.15 / Salida $1.25 / Lectura de caché $0.015
Descuento
-50%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.03
Precio de TokenLab
$0.015
Descuento
-50%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas

Aún no hay datos

Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre gemini-2.5-flash en Console con un prompt listo para editar o enviar.

Ayúdame a probar gemini-2.5-flash con un mensaje breve en /v1beta/models/gemini-2.5-flash:generateContent. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para

Razonamiento

Razonamiento multi-paso, análisis y flujos de investigación

Visión

Leer imágenes, parsear documentos y responder preguntas visuales

01

Agentes y herramientas

Gestiona razonamiento, triaje de soporte, llamadas a herramientas y tareas complejas.

02

Programación

Genera, revisa o depura código directamente en tus herramientas habituales.

03

Asistentes de conocimiento

Crea funciones de chat, búsqueda y recuperación con precios y capacidades transparentes.

04

Comparación directa

Compara calidad, latencia y precio en una misma vista.

Ejemplos de prompts

Escribe una respuesta de soporte concisa y enumera los supuestos detrás.

Revisa este diseño de API y señala los tres principales riesgos de integración.

Convierte un changelog largo en notas de versión que entienda alguien no técnico.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Cuánto cuesta gemini-2.5-flash?

En TokenLab, gemini-2.5-flash cuesta Entrada $0.15 / Salida $1.25 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Para qué es mejor gemini-2.5-flash?

gemini-2.5-flash admite Modo JSON, Caché de prompts, Razonamiento. Puedes abrirlo directamente en Create.

¿Cómo pruebo gemini-2.5-flash?

Abre gemini-2.5-flash en Create para probar un ejemplo preparado para /v1beta/models/gemini-2.5-flash:generateContent.

¿Qué endpoint debe usar gemini-2.5-flash?

Utiliza https://api.tokenlab.sh/v1beta/models/gemini-2.5-flash:generateContent para gemini-2.5-flash. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Puedo probar gemini-2.5-flash antes de integrarlo?

Sí. Abrir Console inicia un borrador listo para gemini-2.5-flash y conserva tu prompt tras iniciar sesión, sin perder contexto.

¿Qué operaciones soporta gemini-2.5-flash?

gemini-2.5-flash admite chat_completion. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Más de Gemini 2.5

Modelos relacionados