Google: Gemini 3.7 Flash
gemini-3.7-flash- Entrée / Sortie-50%
- $0.75 / $3.75$0.375 / $1.88
- Contexte
- 1M
- Date de sortie
- 13 août 2026
- Sortie maximale
- 64K
- Modalités
- VisionDiscussion
- Capacités
- Utilisation d'outilsCache de prompts
À propos de Gemini 3.7 Flash
Gemini 3.7 Flash est un modèle stable de la gamme Flash de Google, sorti en août 2026, que Google décrit comme conçu pour le codage complexe, les flux de travail agentiques et l'exécution fiable en plusieurs étapes. Il lit le texte et les images, prend en charge la réflexion, appelle des outils, renvoie du JSON lié à un schéma et met en cache le contexte. Il se situe un cran au-dessus de 3.6 Flash et un cran en dessous de 3.8 Flash.
Points forts
- La réflexion peut s'effectuer avant la réponse, ce qui aide pour le codage et les tâches en plusieurs étapes.
- L'exécution fiable en plusieurs étapes est l'objectif de conception déclaré, utile lorsqu'un agent ne doit pas perdre le fil.
- L'appel d'outils et le JSON lié à un schéma facilitent l'intégration des résultats dans d'autres systèmes.
- L'entrée d'image prend en charge les captures d'écran, les diagrammes et les documents numérisés.
Quand préférer un autre modèle
- Gemini 3.8 Flash est le modèle plus récent que Google présente comme son modèle Flash le plus performant.
- La réflexion ajoute de la latence, donc les recherches simples sont mieux traitées par Flash-Lite.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteGemini APIPOST/v1beta/models/gemini-3.7-flash:generateContentFormat d'API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Tarification
Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.
Promotional Standard
Par 1M Token- Prix Official
- Entrée $0.75 / Sortie $3.75 / Lecture cache $0.075
- Prix Verified
- Entrée $0.375 / Sortie $1.88 / Lecture cache $0.0375
- Remise
- -50%
Lecture cache
- Prix Official
- $0.075
- Prix Verified
- $0.0375
- Remise
- -50%
Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.
Recherche web
- Prix Official
- $0.014/recherche
- Prix Verified
- $0.007/recherche
- Remise
- -50%
| Prix OfficialPar 1M Token | Prix VerifiedPar 1M Token | Remise | |
|---|---|---|---|
| Promotional Standard | Entrée $0.75 / Sortie $3.75 / Lecture cache $0.075 | Entrée $0.375 / Sortie $1.88 / Lecture cache $0.0375 | -50% |
| Tarification du cache de prompt | |||
| Lecture cache | $0.075 | $0.0375 | -50% |
| Frais d'outilsFacturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle. | |||
| Recherche web | $0.014/recherche | $0.007/recherche | -50% |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
- Taux de réussite sur 30 jours
- 99,8%
- Latence médiane sur 7 jours
- 13,3 sn=278
- Latence P95 sur 7 jours
- 52,4 sn=278
- Requêtes sur 30 jours
- 1K+
- Dernière activité
- il y a 15 heures
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez Gemini 3.7 Flash dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester gemini-3.7-flash avec un message sur /v1beta/models/gemini-3.7-flash:generateContent. Affiche la réponse, la latence et le coût.
Cas d'usage
Idéal pour- Vision
Implémentation de fonctionnalités
Demandez à un agent de lire un ticket, de modifier plusieurs fichiers et d'exécuter des tests.
Automatisation des flux de travail
Enchaînez les approbations, les recherches et les notifications où chaque étape dépend de la précédente.
Revue de code
Lisez un diff, signalez les changements risqués et expliquez chaque constatation afin qu'un relecteur humain puisse décider rapidement quoi accepter.
Nettoyage de données
Réfléchissez aux enregistrements incohérents et proposez des règles de normalisation avant de les appliquer, afin que le nettoyage puisse être audité au préalable.
Exemples de prompts
Lisez ce ticket et les fichiers liés, implémentez le changement et listez les tests que vous avez exécutés.
Examinez ce diff pour détecter les bugs de concurrence et classez les résultats par gravité.
Ces deux enregistrements clients semblent être des doublons. Expliquez quels champs sont en conflit et quelle règle permettrait de les fusionner en toute sécurité.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
À quoi Gemini 3.7 Flash est-il destiné ?
Au codage complexe, aux flux de travail d'agents et à l'exécution en plusieurs étapes qui doit rester fiable du début à la fin. C'est un modèle Flash capable de réflexion avec prise en charge des outils et des images.
Prend-il en charge la réflexion ?
Oui. Il peut raisonner avant de répondre, ce qui améliore les résultats en matière de code et de planification. Limitez cet effort pour les interactions courtes afin de garder des réponses rapides.
En quoi diffère-t-il de 3.6 Flash ?
3.7 Flash est le modèle plus récent et ajoute la réflexion, avec un accent plus marqué sur les exécutions fiables en plusieurs étapes. 3.6 Flash est axé sur les boucles de codage et le raisonnement visuel sans réflexion.
3.8 Flash est-il un meilleur choix ?
Souvent, pour l'ingénierie logicielle à long terme. 3.7 Flash reste un choix judicieux si vous avez déjà optimisé vos prompts pour lui et que ses résultats répondent à vos exigences.
Combien coûte Gemini 3.7 Flash ?
Sur TokenLab, Gemini 3.7 Flash coûte Entrée $0.375 / Sortie $1.88 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de Gemini 3.7 Flash ?
Gemini 3.7 Flash accepte jusqu'à 1 048 576 jetons de contexte et génère jusqu'à 65 536 jetons par réponse.
Quel endpoint Gemini 3.7 Flash doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent pour Gemini 3.7 Flash. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations Gemini 3.7 Flash prend-il en charge ?
Gemini 3.7 Flash prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer Gemini 3.7 Flash
Sources
Mis à jour le 2 oct. 2026