Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

xAI: Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent est la variante de raisonnement collaboratif de Grok 4.20. Il est destiné aux questions exigeantes qui bénéficient de plusieurs pistes d'analyse explorées avant qu'une réponse ne soit assemblée.
Comparer les modèles
grok-4.20-multi-agent
DisponiblexAIDiscussion
Entrée / Sortie
$1.25 / $2.50
Contexte
1M
Sortie maximale
128K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de promptsRaisonnement

À propos de Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent est la variante de Grok 4.20 par xAI qui répond à une question complexe en exécutant plusieurs agents en parallèle. Chaque agent étudie un angle différent, et un agent leader fusionne leurs conclusions en une seule réponse étayée par des preuves. Ce modèle est adapté aux questions de type recherche où l'étendue prime sur la vitesse, contrairement aux modèles 4.20 de raisonnement en une seule passe ou sans raisonnement.

Points forts

  • Répartit une question entre plusieurs agents qui explorent différents angles simultanément, puis fusionne les résultats en une seule réponse.
  • Un agent leader rédige la réponse finale, vous recevez donc une réponse cohérente plutôt qu'une accumulation de conclusions partielles.
  • xAI documente des configurations d'environ quatre agents pour une recherche rapide et seize pour une analyse approfondie, en fonction du niveau d'effort.
  • Adapté aux questions nécessitant la collecte de sources et des vérifications croisées plutôt qu'une simple étape de rappel.
  • Lit les images ainsi que le texte lorsque la question inclut des captures d'écran ou des illustrations.

Quand préférer un autre modèle

  • L'exécution de plusieurs agents prend plus de temps et utilise plus de jetons qu'une seule passe ; un modèle 4.20 standard est préférable pour des recherches simples.
  • Seule la réponse finale du leader est visible, vous ne pouvez donc pas inspecter les conclusions de chaque sous-agent.
  • Il s'agit d'une variante orientée recherche ; pour un agent de codage ou d'appel d'outils conventionnel, grok-4.7 est le choix le plus direct.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-multi-agent",
        "input": "Hello!"
      }'

Tarification

Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.

Spécification par défaut

Par 1M Token
Tarif Official
Entrée $1.25 / Sortie $2.50 / Lecture cache $0.20
Official
Entrée $1.25 / Sortie $2.50 / Lecture cache $0.20
Remise
—
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.20
Official
$0.20
Remise
—

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Grok 4.20 Multi-Agent dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester grok-4.20-multi-agent avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Raisonnement
  • Vision
  • Études de marché et de la concurrence

    Demandez une vue d'ensemble sourcée d'une catégorie de produits, chaque agent couvrant différents fournisseurs ou angles, et recevez un briefing synthétisé unique.

  • Revues de littérature et de politiques

    Posez une question couvrant de nombreux documents ou réglementations et laissez des agents parallèles rassembler les points pertinents avant que le leader ne réconcilie les divergences.

  • Analyse complexe ouverte

    Soumettez une question sans méthode évidente, telle que la raison de l'évolution d'une métrique, et obtenez une vue consolidée construite à partir de plusieurs axes d'analyse.

Exemples de prompts

Comparez les principales approches d'indexation pour la recherche vectorielle sur un corpus de dix millions de documents. Couvrez la précision, l'utilisation de la mémoire et la complexité opérationnelle, puis recommandez-en une.

Quelles sont les questions juridiques ouvertes concernant l'entraînement de modèles sur des images sous licence ? Présentez les positions concurrentes et les preuves pour chacune.

Nos inscriptions ont chuté de 18 pour cent le mois dernier. Proposez cinq explications indépendantes et indiquez quelles données permettraient de confirmer ou d'infirmer chacune d'elles.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Que fait la version multi-agents de Grok 4.20 ?

Elle lance plusieurs agents qui travaillent sur une question en parallèle. Ils rassemblent et analysent des informations sous différents angles, puis un agent leader combine la discussion en une réponse finale unique. Vous envoyez une requête normale et recevez une seule réponse.

Combien d'agents grok-4.20-multi-agent utilise-t-il ?

xAI décrit deux configurations : quatre agents pour une recherche rapide et ciblée, et seize pour une analyse approfondie et complexe. Le nombre dépend de l'effort de raisonnement demandé, un faible effort correspondant à la plus petite équipe et un effort élevé à la plus grande.

grok-4.20-multi-agent est-il plus lent que grok-4.20 ?

Généralement oui. Plusieurs agents explorent la question avant que le leader ne rédige la réponse, donc la latence et l'utilisation des jetons augmentent avec le nombre d'agents. Pour des questions courtes ou du chat, les modèles 4.20 standard ou sans raisonnement répondent plus rapidement.

Puis-je voir ce que chaque agent a conclu ?

Non. xAI expose uniquement la sortie de l'agent leader, et l'état de travail des sous-agents n'est pas renvoyé. Demandez au modèle de citer les preuves dans sa réponse finale si vous devez vérifier comment une conclusion a été atteinte.

Accepte-t-il les images ?

Oui. Comme les autres modèles 4.20, il accepte les images avec du texte, donc une question de recherche peut inclure un graphique ou une capture d'écran. La réponse est fournie sous forme de texte.

Combien coûte Grok 4.20 Multi-Agent ?

Sur TokenLab, Grok 4.20 Multi-Agent coûte Entrée $1.25 / Sortie $2.50 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de Grok 4.20 Multi-Agent ?

Grok 4.20 Multi-Agent accepte jusqu'à 1 000 000 jetons de contexte et génère jusqu'à 131 072 jetons par réponse.

Quel endpoint Grok 4.20 Multi-Agent doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour Grok 4.20 Multi-Agent. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Grok 4.20 Multi-Agent prend-il en charge ?

Grok 4.20 Multi-Agent prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Grok 4.20 Multi-Agent

Sources

Mis à jour le 2 oct. 2026

Plus de la série Grok 4

Modèles associés