Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

xAI: Grok 4.6

Grok 4.6 gère les entrées de texte et d'image avec l'appel d'outils et une grande fenêtre de contexte. Il peut intégrer des documents de référence et des captures d'écran dans la même conversation de travail pour l'analyse, l'écriture ou l'assistance logicielle.
Comparer les modèles
grok-4.6
DisponiblexAIDiscussionEntrée en cache : 75% de réduction
Entrée / Sortie-50%
$2.00 / $6.00$1.00 / $3.00
Contexte
500K
Date de sortie
12 août 2026
Sortie maximale
128K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de prompts

À propos de Grok 4.6

Grok 4.6 est le modèle de xAI pour le codage, le travail agentique et les tâches à forte intensité de connaissances, publié entre Grok 4.5 et 4.7. Il lit le texte et les images, écrit du texte et offre un effort de raisonnement allant de low à xhigh, avec high par défaut. Les équipes l'utilisent pour intégrer des documents de référence et des captures d'écran dans une seule conversation de travail pour l'analyse, la rédaction ou l'aide logicielle.

Points forts

  • Gère les documents et les captures d'écran dans la même conversation, de sorte qu'un rapport de bug avec une image ne nécessite aucun prétraitement séparé.
  • L'effort de raisonnement comporte quatre niveaux, de low à xhigh, avec high activé par défaut pour les questions plus difficiles.
  • L'appel de fonctions et les sorties structurées le rendent utilisable comme moteur d'un assistant utilisant des outils.
  • Destiné au travail intellectuel ainsi qu'au code, ce qui convient aux tâches d'analyse et de rédaction longue.
  • La mise en cache des invites aide lorsqu'un grand ensemble de références est réutilisé au cours d'une session.

Quand préférer un autre modèle

  • Grok 4.7 lui a succédé en tant que modèle phare de xAI, donc 4.6 convient principalement aux invites déjà validées sur celui-ci.
  • C'est un modèle à sortie textuelle ; la création d'images ou d'audio nécessite un modèle différent.
  • Les paramètres de raisonnement intensif allongent les réponses, donc les conversations sensibles à la latence peuvent mieux fonctionner avec un effort moindre ou un modèle sans raisonnement.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.6",
        "input": "Hello!"
      }'

Tarification

Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.

Entrée tokens <= 200K

Par 1M Token
Tarif Official
Entrée $2.00 / Sortie $6.00 / Lecture cache $0.50
Prix TokenLab
Entrée $1.00 / Sortie $3.00 / Lecture cache $0.25
Remise
-50%

Entrée tokens 200K-500K

Par 1M Token
Tarif Official
Entrée $4.00 / Sortie $12.00 / Lecture cache $1.00
Prix TokenLab
Entrée $2.00 / Sortie $6.00 / Lecture cache $0.50
Remise
-50%
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.50
Prix TokenLab
$0.25
Remise
-50%

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Grok 4.6 dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester grok-4.6 avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Vision
  • Analyse de documents avec figures

    Téléchargez un rapport avec ses graphiques sous forme d'images et demandez les incohérences entre le récit et les chiffres présentés.

  • Assistance logicielle

    Diagnostiquez une défaillance de build à partir des journaux et d'une capture d'écran de l'erreur, proposez un correctif et expliquez le changement en langage clair.

  • Rédaction de travail intellectuel

    Transformez une pile de notes de réunion et de matériel de référence en un briefing structuré, en gardant les affirmations liées aux sources fournies.

Exemples de prompts

Voici le texte du rapport trimestriel et le graphique des revenus. Dites-moi où les affirmations écrites sont en désaccord avec le graphique.

Ce journal CI et cette capture d'écran montrent la même défaillance. Expliquez la cause probable et donnez un correctif minimal.

Combinez les notes jointes en un résumé d'une page pour une nouvelle recrue. Marquez toute déclaration qui repose sur une seule note.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

À quoi sert Grok 4.6 ?

xAI l'a conçu pour le codage, les tâches agentiques et le travail intellectuel. Il accepte le texte et les images, appelle des outils, renvoie des sorties structurées et raisonne avec un effort ajustable. Les utilisations typiques sont l'assistance au code et l'analyse de documents avec des figures.

Quels sont les paramètres de raisonnement sur Grok 4.6 ?

L'effort de raisonnement peut être low, medium, high ou xhigh, et high est la valeur par défaut. Choisissez un niveau inférieur pour des échanges rapides et un niveau supérieur pour le débogage, la planification ou l'analyse où la précision est primordiale.

Grok 4.6 accepte-t-il les entrées d'images ?

Oui. Le texte et les images sont acceptés, et la réponse est du texte. Cela permet à une seule requête de contenir un document ainsi que des captures d'écran de ce sur quoi vous posez des questions.

En quoi Grok 4.6 diffère-t-il de Grok 4.7 ?

Les deux partagent les mêmes types d'entrée, la prise en charge des outils et les niveaux d'effort. Grok 4.7 est la version la plus récente et le modèle de pointe recommandé par xAI. Gardez 4.6 là où vous avez optimisé les invites et testé les résultats.

Puis-je obtenir du JSON à partir de Grok 4.6 ?

Oui. Les sorties structurées sont prises en charge, vous pouvez donc transmettre un schéma et recevoir une réponse qui y correspond. Cela fonctionne parallèlement à l'appel de fonctions dans les flux de travail basés sur des outils.

Combien coûte Grok 4.6 ?

Sur TokenLab, Grok 4.6 coûte Entrée $1.00 / Sortie $3.00 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de Grok 4.6 ?

Grok 4.6 accepte jusqu'à 500 000 jetons de contexte et génère jusqu'à 131 072 jetons par réponse.

Quel endpoint Grok 4.6 doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour Grok 4.6. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Grok 4.6 prend-il en charge ?

Grok 4.6 prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Grok 4.6

Sources

Mis à jour le 2 oct. 2026

Plus de la série Grok 4

Modèles associés