Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

Google: Gemini 3.6 Flash

Gemini 3.6 Flash se concentre sur les boucles de codage efficaces, l'orchestration d'outils et le raisonnement visuel. Il est particulièrement adapté aux agents qui inspectent régulièrement les résultats, révisent le code et décident de l'action suivante au sein d'une tâche plus vaste.
Comparer les modèles
gemini-3.6-flash
DisponibleGoogleDiscussionEntrée en cache : 90% de réduction
Entrée / Sortie
$0.75 / $3.75
Contexte
1M
Date de sortie
21 juil. 2026
Sortie maximale
64K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de prompts

À propos de Gemini 3.6 Flash

Gemini 3.6 Flash est un modèle stable de la gamme Flash de Gemini que Google décrit comme équilibrant vitesse et capacité multimodale. Il a été publié en juillet 2026, entre Flash 3.5 et Flash 3.7. Google le positionne autour des boucles de codage efficaces, de l'orchestration d'outils et du raisonnement visuel ; il convient donc aux agents qui inspectent un résultat, le révisent et décident de l'action suivante.

Points forts

  • S'adapte aux boucles dans lesquelles un agent exécute du code, lit le résultat et révise.
  • L'orchestration d'outils sur plusieurs appels est un objectif déclaré.
  • Le raisonnement visuel sur des captures d'écran et des diagrammes fonctionne dans la même requête que le texte.
  • Le JSON conforme à un schéma et la mise en cache prennent en charge une utilisation en production répétable.

Quand préférer un autre modèle

  • Les modèles Flash 3.7 et 3.8 sont plus récents et sont destinés à un codage plus complexe et à des exécutions autonomes plus longues.
  • Il ne dispose pas de mode de réflexion dédié ; il est donc préférable d'effectuer une délibération approfondie sur un modèle Pro.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteGemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    Format d'API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Tarification

Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.

Spécification par défaut

Par 1M Token
Tarif Official
Entrée $0.75 / Sortie $3.75 / Lecture cache $0.075
Prix TokenLab
Entrée $0.75 / Sortie $3.75 / Lecture cache $0.075
Remise
—
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.075
Prix TokenLab
$0.075
Remise
—
Frais d'outils

Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.

Recherche web

Tarif Official
$0.014/recherche
Prix TokenLab
$0.007/recherche
Remise
-50%

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Taux de réussite sur 30 jours
99,7%
Requêtes sur 30 jours
100+
Dernière activité
il y a 17 heures

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Gemini 3.6 Flash dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester gemini-3.6-flash avec un message sur /v1beta/models/gemini-3.6-flash:generateContent. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Vision
  • Boucles de correction de code

    Laisser un agent exécuter des tests, lire les échecs, corriger les fichiers et répéter jusqu'à ce qu'ils réussissent.

  • Inspection d'interface utilisateur

    Comparer une capture d'écran avec une spécification écrite et lister chaque écart d'espacement, de couleur ou de mise en page qu'un réviseur doit corriger.

  • Assistants utilisant de nombreux outils

    Coordonner les appels de recherche, de calendrier et de CRM au sein d'une même conversation, en transmettant les résultats de chaque outil à la décision suivante.

  • Questions-réponses multimodales

    Répondre à des questions nécessitant à la fois l'image d'un graphique et le texte du rapport associé.

Exemples de prompts

Exécutez les tests, lisez le résultat de l'échec et modifiez uniquement la fonction qui fait échouer le deuxième test.

Comparez cette capture d'écran avec la spécification de conception et listez chaque écart d'espacement ou de couleur.

Vérifiez mon calendrier et le CRM, puis rédigez une réponse proposant deux créneaux de réunion.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

En quoi Gemini 3.6 Flash excelle-t-il ?

Le travail itératif des agents : boucles de codage, orchestration d'outils et raisonnement sur des images. Il équilibre la vitesse et la capacité multimodale, ce qui en fait un choix par défaut raisonnable pour les agents qui n'ont pas besoin du tout dernier modèle Flash.

En quoi est-il différent de Flash 3.5 ?

3.6 est la version ultérieure et est décrite autour des boucles de codage et de l'utilisation d'outils, tandis que Flash 3.5 est la référence pour le travail courant à haut volume. Attendez-vous à un meilleur comportement des agents avec la version 3.6.

Dois-je passer à Flash 3.8 ?

Si vous exécutez des tâches logicielles longues ou des flux d'entreprise complexes, Flash 3.8 est celui que Google positionne pour ces usages. Pour des agents plus simples, 3.6 peut suffire ; testez les deux avec vos propres traces.

Accepte-t-il les images ?

Oui. Les images et le texte peuvent être combinés dans une seule requête, et le modèle répond en texte ou en JSON suivant un schéma que vous fournissez. Il ne génère pas d'images lui-même.

Combien coûte Gemini 3.6 Flash ?

Sur TokenLab, Gemini 3.6 Flash coûte Entrée $0.75 / Sortie $3.75 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de Gemini 3.6 Flash ?

Gemini 3.6 Flash accepte jusqu'à 1 048 576 jetons de contexte et génère jusqu'à 65 536 jetons par réponse.

Quel endpoint Gemini 3.6 Flash doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent pour Gemini 3.6 Flash. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Gemini 3.6 Flash prend-il en charge ?

Gemini 3.6 Flash prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Gemini 3.6 Flash

Sources

Mis à jour le 2 oct. 2026

Plus de la série Gemini 3

Modèles associés