xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- Entrée / Sortie-50%
- $1.25 / $2.50$0.625 / $1.25
- Contexte
- 1M
- Sortie maximale
- 128K
- Modalités
- VisionDiscussion
- Capacités
- Utilisation d'outilsCache de prompts
À propos de Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning est la version à réponse directe du modèle 4.20 de xAI. Il ignore la phase de réflexion étendue, répond donc rapidement aux requêtes textuelles et aux images, et convient à la rédaction, à l'extraction et au chat assisté par outils. xAI le décrit comme combinant un respect strict des instructions et un faible taux d'hallucination. Choisissez les variantes de raisonnement ou multi-agents lorsqu'un problème nécessite une analyse approfondie.
Points forts
- Répond sans phase de réflexion séparée, ce qui maintient une faible latence pour le chat interactif et les tâches à haut volume.
- xAI souligne le respect strict des instructions et un faible taux d'hallucination pour ce modèle, utile lorsque la sortie doit suivre un modèle précis.
- Prend en charge l'appel de fonctions et la sortie JSON structurée pour les pipelines d'extraction et les assistants pilotés par outils.
- Accepte les images avec du texte, il peut donc lire un reçu ou une capture d'écran et répondre en une seule étape.
- La mise en cache des requêtes (prompt caching) est utile lorsque de nombreuses demandes réutilisent les mêmes instructions longues ou textes de référence.
Quand préférer un autre modèle
- Sans étape de raisonnement, il est moins performant sur la logique à plusieurs étapes ou les mathématiques que grok-4.20 ou grok-4.7.
- Il ne répartit pas le travail entre plusieurs agents ; la recherche ouverte est mieux servie par la variante multi-agents.
- La sortie est uniquement textuelle, sans génération d'image, d'audio ou de vidéo.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteResponses APIPOST/v1/responsesFormat d'API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
Tarification
Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.
Spécification par défaut
Par 1M Token- Tarif Official
- Entrée $1.25 / Sortie $2.50 / Lecture cache $0.20
- Prix TokenLab
- Entrée $0.625 / Sortie $1.25 / Lecture cache $0.10
- Remise
- -50%
Lecture cache
- Tarif Official
- $0.20
- Prix TokenLab
- $0.10
- Remise
- -50%
| Tarif OfficialPar 1M Token | Prix TokenLabPar 1M Token | Remise | |
|---|---|---|---|
| Spécification par défaut | Entrée $1.25 / Sortie $2.50 / Lecture cache $0.20 | Entrée $0.625 / Sortie $1.25 / Lecture cache $0.10 | -50% |
| Tarification du cache de prompt | |||
| Lecture cache | $0.20 | $0.10 | -50% |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez Grok 4.20 Non-Reasoning dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester grok-4.20-non-reasoning avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.
Cas d'usage
Idéal pour- Vision
Chat avec les clients
Répondez aux questions sur les produits et les comptes avec un ton cohérent, en appelant des fonctions de recherche si nécessaire, sans faire attendre le client pendant une longue phase de réflexion.
Extraction de documents en masse
Traitez des milliers de contrats, formulaires ou e-mails via un schéma JSON fixe, en vous appuyant sur le respect strict des instructions pour maintenir la cohérence des champs.
Rédaction et réécriture
Produisez des premières versions d'e-mails, de résumés et de notes de version dans un format demandé, puis affinez-les avec de courtes instructions de suivi.
Exemples de prompts
Résumez ce fil de support en trois points et une suggestion de réponse. Gardez la réponse sous les 80 mots et ne promettez pas de remboursement.
Extrayez les noms des parties, la date d'entrée en vigueur et le délai de préavis de résiliation de ce contrat vers le schéma JSON ci-dessous. Retournez null pour tout élément manquant.
Réécrivez ce journal des modifications pour des clients non techniques. Gardez les titres, supprimez les numéros de ticket internes et utilisez des phrases simples.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
Qu'est-ce que Grok 4.20 Non-Reasoning ?
C'est la version du Grok 4.20 de xAI qui répond directement au lieu de réfléchir au préalable. Il lit le texte et les images, écrit du texte et prend en charge l'appel de fonctions et les sorties structurées. Il est destiné aux tâches rapides et riches en instructions telles que l'extraction, la rédaction et le chat assisté par outils.
Quand dois-je utiliser le modèle sans raisonnement plutôt que grok-4.20 ?
Utilisez-le lorsque la tâche est claire et que la réponse repose principalement sur le rappel, la réécriture ou le formatage. Il répond plus rapidement que l'ID de raisonnement. Passez à grok-4.20 lorsque la réponse nécessite plusieurs étapes d'analyse, comme le débogage ou la planification.
Grok 4.20 Non-Reasoning suit-il les schémas JSON ?
Oui. Il prend en charge les sorties structurées, vous pouvez donc fournir un schéma et recevoir une réponse qui y correspond. Combiné à l'accent mis par xAI sur le respect strict des instructions, cela en fait un choix par défaut raisonnable pour les tâches d'extraction et de classification.
Peut-il accepter des images en entrée ?
Oui, les images peuvent être envoyées avec du texte, par exemple un formulaire photographié ou une capture d'écran d'interface. La réponse est textuelle. Le modèle ne peut pas créer ou modifier d'images.
Fonctionne-t-il avec un client existant de style OpenAI ?
Oui. Le code client existant de style OpenAI fonctionne en changeant uniquement le nom du modèle, les définitions d'outils et les schémas JSON étant envoyés dans les champs habituels comme auparavant.
Combien coûte Grok 4.20 Non-Reasoning ?
Sur TokenLab, Grok 4.20 Non-Reasoning coûte Entrée $0.625 / Sortie $1.25 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de Grok 4.20 Non-Reasoning ?
Grok 4.20 Non-Reasoning accepte jusqu'à 1 000 000 jetons de contexte et génère jusqu'à 131 072 jetons par réponse.
Quel endpoint Grok 4.20 Non-Reasoning doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/responses pour Grok 4.20 Non-Reasoning. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations Grok 4.20 Non-Reasoning prend-il en charge ?
Grok 4.20 Non-Reasoning prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer Grok 4.20 Non-Reasoning
Sources
Mis à jour le 2 oct. 2026