MiniMax: MiniMax-M2.5-highspeed
minimax-m2.5-highspeed- Entrée / Sortie
- $0.60 / $2.40
- Contexte
- 205K
- Sortie maximale
- 64K
- Modalités
- Discussion
- Capacités
- Utilisation d'outilsCache de prompts
À propos de MiniMax-M2.5-highspeed
MiniMax-M2.5-highspeed est l'option de service plus rapide de MiniMax-M2.5, le modèle de février 2026 optimisé pour la programmation, l'appel d'outils, la recherche et la productivité bureautique. MiniMax indique que M2.5 et sa version highspeed donnent des résultats identiques, la version highspeed étant plus rapide à l'exécution. Il effectue du raisonnement, appelle des outils et met en cache les invites (prompts), dans le but de réduire la latence pour le codage et les flux de travail d'agents.
Points forts
- MiniMax affirme que la version highspeed produit les mêmes résultats que M2.5 tout en générant plus rapidement.
- M2.5 cible le codage, l'appel d'outils et la recherche, ainsi que le travail de productivité bureautique.
- Le raisonnement, l'utilisation d'outils et la mise en cache des invites sont tous disponibles.
- Les poids de M2.5 sont publiés ouvertement, ce qui permet de vérifier le comportement par rapport à une copie auto-hébergée.
Quand préférer un autre modèle
- Entrée textuelle uniquement ; les diagrammes et les photos doivent donc être décrits par des mots.
- Pas de mode de schéma de réponse, contrairement à M2.1 ; la sortie structurée repose sur l'invitation (prompting) et la validation dans votre code.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteResponses APIPOST/v1/responsesFormat d'API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
Tarification
Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.
Spécification par défaut
Par 1M Token- Prix Official
- Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375
- Prix Verified
- —
- Remise
- —
Lecture cache
- Prix Official
- $0.03
- Prix Verified
- —
- Remise
- —
Jetons d'écriture cache
- Prix Official
- $0.375
- Prix Verified
- —
- Remise
- —
| Prix OfficialPar 1M Token | Prix VerifiedPar 1M Token | Remise | |
|---|---|---|---|
| Spécification par défaut | Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375 | — | — |
| Tarification du cache de prompt | |||
| Lecture cache | $0.03 | — | — |
| Jetons d'écriture cache | $0.375 | — | — |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez MiniMax-M2.5-highspeed dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester minimax-m2.5-highspeed avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.
Cas d'usage
Agents de codage à faible latence
Maintenez un agent réactif pendant qu'il lit des fichiers, exécute des commandes et révise son plan.
Pipelines de recherche et d'outils
Enchaînez des outils Web ou de base de données où chaque étape du modèle attend un résultat de récupération.
Automatisation des tâches de bureau
Rédigez et révisez des feuilles de calcul, des rapports ou du texte de diapositives lorsque plusieurs cycles rapides sont nécessaires.
Exemples de prompts
Recherchez dans le dépôt chaque utilisation du client obsolète, listez les fichiers et corrigez les plus simples.
Résumez les tickets de ce trimestre par thème, puis rédigez trois points clés pour une mise à jour hebdomadaire.
Appelez lookup_price pour chaque SKU de la liste et signalez ceux qui ont changé.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
En quoi M2.5-highspeed diffère-t-il de M2.5 ?
MiniMax décrit les deux comme identiques en termes de capacités, ne différant que par la vitesse. Utilisez la version highspeed lorsque le délai entre les étapes est important dans une boucle interactive ou un agent.
Pour quoi M2.5 a-t-il été conçu ?
La note de version de MiniMax indique qu'il a atteint des résultats de premier plan en programmation, en appel d'outils, en recherche et en productivité bureautique. Il s'agit d'un modèle d'agent généraliste plutôt que d'un modèle dédié uniquement au codage.
Prend-il en charge la sortie de schéma JSON structuré ?
Aucun schéma de réponse n'est proposé pour ce modèle, bien que l'utilisation d'outils soit prise en charge. Si vous avez besoin d'une sortie strictement typée, validez-la dans votre code ou utilisez M2.1, qui dispose d'une sortie de schéma.
Est-il open source ?
Les poids de M2.5 sont publiés sur Hugging Face sous MiniMaxAI. Le nom highspeed fait référence à la manière dont le modèle est servi et à la rapidité avec laquelle il répond, et non à un modèle différent.
Dois-je utiliser M2.5-highspeed ou M2.7-highspeed ?
Essayez M2.7-highspeed pour les nouvelles fonctionnalités d'agent telles que les compétences et la recherche d'outils dynamique. Gardez M2.5-highspeed si vos invites sont optimisées pour celui-ci et que les résultats sont stables.
Combien coûte MiniMax-M2.5-highspeed ?
Sur TokenLab, MiniMax-M2.5-highspeed coûte Entrée $0.60 / Sortie $2.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de MiniMax-M2.5-highspeed ?
MiniMax-M2.5-highspeed accepte jusqu'à 204 800 jetons de contexte et génère jusqu'à 65 536 jetons par réponse.
Quel endpoint MiniMax-M2.5-highspeed doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/responses pour MiniMax-M2.5-highspeed. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations MiniMax-M2.5-highspeed prend-il en charge ?
MiniMax-M2.5-highspeed prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer MiniMax-M2.5-highspeed
Sources
Mis à jour le 2 oct. 2026