MiniMax: MiniMax-M2.1-highspeed
minimax-m2.1-highspeed- Entrée / Sortie
- $0.60 / $2.40
- Contexte
- 205K
- Sortie maximale
- 128K
- Modalités
- Discussion
- Capacités
- Utilisation d'outilsCache de prompts
À propos de MiniMax-M2.1-highspeed
MiniMax-M2.1-highspeed est la version axée sur la vitesse du modèle M2.1 de MiniMax pour le codage et les tâches assistées par outils. Il est adapté aux boucles d'agents interactives dans lesquelles une application alterne entre des instructions générées, des résultats d'outils et la réponse suivante. Il conserve le raisonnement, l'utilisation d'outils, le mode JSON et la sortie de schéma du M2.1, sans sacrifier aucune fonctionnalité pour obtenir des tours plus rapides.
Points forts
- Destiné aux boucles où le modèle répond, un outil s'exécute, puis le modèle répond à nouveau, de sorte que le délai de chaque tour s'accumule.
- Conserve le mode JSON et la sortie contrainte par schéma du M2.1.
- Le raisonnement est disponible lorsqu'une étape en a besoin.
- L'utilisation d'outils et la mise en cache des invites (prompt caching) sont toutes deux prises en charge.
Quand préférer un autre modèle
- Texte uniquement ; les captures d'écran et autres images ne peuvent pas être envoyées.
- M2.5-highspeed et M2.7-highspeed sont des variantes rapides ultérieures qui pourraient mieux convenir aux nouvelles versions.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteResponses APIPOST/v1/responsesFormat d'API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.1-highspeed", "input": "Hello!" }'
Tarification
Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.
Spécification par défaut
Par 1M Token- Prix Official
- Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375
- Prix Verified
- —
- Remise
- —
Lecture cache
- Prix Official
- $0.03
- Prix Verified
- —
- Remise
- —
Jetons d'écriture cache
- Prix Official
- $0.375
- Prix Verified
- —
- Remise
- —
| Prix OfficialPar 1M Token | Prix VerifiedPar 1M Token | Remise | |
|---|---|---|---|
| Spécification par défaut | Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375 | — | — |
| Tarification du cache de prompt | |||
| Lecture cache | $0.03 | — | — |
| Jetons d'écriture cache | $0.375 | — | — |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez MiniMax-M2.1-highspeed dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester minimax-m2.1-highspeed avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.
Cas d'usage
Assistants de codage interactifs
Alimentent un assistant intégré à l'éditeur qui doit répondre rapidement à chaque instruction pendant qu'il lit et modifie des fichiers.
Boucles d'agents avec de nombreuses étapes courtes
Cycles d'exécution de plan, d'appel d'outil et de lecture de résultat où la latence du modèle domine le temps total de la tâche.
Réponses structurées dans des applications en direct
Renvoient un JSON conforme au schéma vers une interface frontale qui attend la réponse.
Exemples de prompts
Ouvrez utils/date.ts, trouvez le bug de fuseau horaire et corrigez-le. Ensuite, exécutez les tests et ne signalez que les échecs.
À partir de ces résultats d'outils, décidez de la prochaine action unique et sortez-la sous forme de JSON avec les champs action et args.
Renommez la fonction dans les fichiers listés et affichez un diff pour chacun.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
Quelle est la version highspeed de MiniMax-M2.1 ?
Il s'agit de la même génération M2.1 présentée comme une option axée sur la vitesse pour le codage et les tâches assistées par outils. Choisissez-la lorsque le délai entre les étapes d'un agent interactif est important.
Perd-il des fonctionnalités par rapport au M2.1 ?
Non. Il conserve l'ensemble des fonctionnalités du M2.1 : raisonnement, utilisation d'outils, mise en cache des invites, mode JSON et schéma de réponse ; le changement concerne donc la vitesse des tours. La qualité sur vos propres tâches mérite toujours d'être testée.
Puis-je l'utiliser pour une sortie structurée ?
Oui. Le mode JSON et un schéma de réponse sont tous deux marqués comme pris en charge, vous pouvez donc exiger une sortie sous une forme fixe et l'analyser dans votre application.
Existe-t-il un modèle MiniMax rapide plus récent ?
Oui. MiniMax a sorti plus tard M2.5-highspeed et M2.7-highspeed comme options plus rapides. Comparez-les sur vos propres tâches si vous démarrez un nouveau projet plutôt que de conserver une intégration existante.
Prend-il en charge les images ?
Non. Il n'a pas d'entrée d'image, il ne lit et n'écrit donc que du texte. Choisissez MiniMax M3 lorsqu'une invite nécessite une compréhension d'image ou de vidéo. Il ne prend en entrée que des invites textuelles et des résultats d'outils.
Combien coûte MiniMax-M2.1-highspeed ?
Sur TokenLab, MiniMax-M2.1-highspeed coûte Entrée $0.60 / Sortie $2.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de MiniMax-M2.1-highspeed ?
MiniMax-M2.1-highspeed accepte jusqu'à 204 800 jetons de contexte et génère jusqu'à 131 072 jetons par réponse.
Quel endpoint MiniMax-M2.1-highspeed doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/responses pour MiniMax-M2.1-highspeed. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations MiniMax-M2.1-highspeed prend-il en charge ?
MiniMax-M2.1-highspeed prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer MiniMax-M2.1-highspeed
Sources
Mis à jour le 2 oct. 2026