Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

MiniMax: MiniMax-M2.1-highspeed

MiniMax M2.1 Highspeed est un modèle axé sur la vitesse pour le codage et les tâches assistées par outils. Il est utile pour les boucles d'agents interactives dans lesquelles une application alterne entre des instructions générées, des résultats d'outils et la réponse suivante.
Comparer les modèles
minimax-m2.1-highspeed
DisponibleMiniMaxDiscussion
Entrée / Sortie
$0.60 / $2.40
Contexte
205K
Sortie maximale
128K
Modalités
Discussion
Capacités
Utilisation d'outilsCache de prompts

À propos de MiniMax-M2.1-highspeed

MiniMax-M2.1-highspeed est la version axée sur la vitesse du modèle M2.1 de MiniMax pour le codage et les tâches assistées par outils. Il est adapté aux boucles d'agents interactives dans lesquelles une application alterne entre des instructions générées, des résultats d'outils et la réponse suivante. Il conserve le raisonnement, l'utilisation d'outils, le mode JSON et la sortie de schéma du M2.1, sans sacrifier aucune fonctionnalité pour obtenir des tours plus rapides.

Points forts

  • Destiné aux boucles où le modèle répond, un outil s'exécute, puis le modèle répond à nouveau, de sorte que le délai de chaque tour s'accumule.
  • Conserve le mode JSON et la sortie contrainte par schéma du M2.1.
  • Le raisonnement est disponible lorsqu'une étape en a besoin.
  • L'utilisation d'outils et la mise en cache des invites (prompt caching) sont toutes deux prises en charge.

Quand préférer un autre modèle

  • Texte uniquement ; les captures d'écran et autres images ne peuvent pas être envoyées.
  • M2.5-highspeed et M2.7-highspeed sont des variantes rapides ultérieures qui pourraient mieux convenir aux nouvelles versions.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.1-highspeed",
        "input": "Hello!"
      }'

Tarification

Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.

Spécification par défaut

Par 1M Token
Prix Official
Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375
Prix Verified
—
Remise
—
Tarification du cache de prompt

Lecture cache

Prix Official
$0.03
Prix Verified
—
Remise
—

Jetons d'écriture cache

Prix Official
$0.375
Prix Verified
—
Remise
—

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez MiniMax-M2.1-highspeed dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester minimax-m2.1-highspeed avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

  • Assistants de codage interactifs

    Alimentent un assistant intégré à l'éditeur qui doit répondre rapidement à chaque instruction pendant qu'il lit et modifie des fichiers.

  • Boucles d'agents avec de nombreuses étapes courtes

    Cycles d'exécution de plan, d'appel d'outil et de lecture de résultat où la latence du modèle domine le temps total de la tâche.

  • Réponses structurées dans des applications en direct

    Renvoient un JSON conforme au schéma vers une interface frontale qui attend la réponse.

Exemples de prompts

Ouvrez utils/date.ts, trouvez le bug de fuseau horaire et corrigez-le. Ensuite, exécutez les tests et ne signalez que les échecs.

À partir de ces résultats d'outils, décidez de la prochaine action unique et sortez-la sous forme de JSON avec les champs action et args.

Renommez la fonction dans les fichiers listés et affichez un diff pour chacun.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Quelle est la version highspeed de MiniMax-M2.1 ?

Il s'agit de la même génération M2.1 présentée comme une option axée sur la vitesse pour le codage et les tâches assistées par outils. Choisissez-la lorsque le délai entre les étapes d'un agent interactif est important.

Perd-il des fonctionnalités par rapport au M2.1 ?

Non. Il conserve l'ensemble des fonctionnalités du M2.1 : raisonnement, utilisation d'outils, mise en cache des invites, mode JSON et schéma de réponse ; le changement concerne donc la vitesse des tours. La qualité sur vos propres tâches mérite toujours d'être testée.

Puis-je l'utiliser pour une sortie structurée ?

Oui. Le mode JSON et un schéma de réponse sont tous deux marqués comme pris en charge, vous pouvez donc exiger une sortie sous une forme fixe et l'analyser dans votre application.

Existe-t-il un modèle MiniMax rapide plus récent ?

Oui. MiniMax a sorti plus tard M2.5-highspeed et M2.7-highspeed comme options plus rapides. Comparez-les sur vos propres tâches si vous démarrez un nouveau projet plutôt que de conserver une intégration existante.

Prend-il en charge les images ?

Non. Il n'a pas d'entrée d'image, il ne lit et n'écrit donc que du texte. Choisissez MiniMax M3 lorsqu'une invite nécessite une compréhension d'image ou de vidéo. Il ne prend en entrée que des invites textuelles et des résultats d'outils.

Combien coûte MiniMax-M2.1-highspeed ?

Sur TokenLab, MiniMax-M2.1-highspeed coûte Entrée $0.60 / Sortie $2.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de MiniMax-M2.1-highspeed ?

MiniMax-M2.1-highspeed accepte jusqu'à 204 800 jetons de contexte et génère jusqu'à 131 072 jetons par réponse.

Quel endpoint MiniMax-M2.1-highspeed doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour MiniMax-M2.1-highspeed. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations MiniMax-M2.1-highspeed prend-il en charge ?

MiniMax-M2.1-highspeed prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer MiniMax-M2.1-highspeed

Sources

Mis à jour le 2 oct. 2026

Plus de la série MiniMax

Modèles associés