Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

MiniMax: MiniMax-M2.5-highspeed

Modèle MiniMax haute vitesse pour le codage à faible latence et les flux de travail d'agents
Comparer les modèles
minimax-m2.5-highspeed
DisponibleMiniMaxDiscussion
Entrée / Sortie
$0.60 / $2.40
Contexte
205K
Sortie maximale
64K
Modalités
Discussion
Capacités
Utilisation d'outilsCache de prompts

À propos de MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed est l'option de service plus rapide de MiniMax-M2.5, le modèle de février 2026 optimisé pour la programmation, l'appel d'outils, la recherche et la productivité bureautique. MiniMax indique que M2.5 et sa version highspeed donnent des résultats identiques, la version highspeed étant plus rapide à l'exécution. Il effectue du raisonnement, appelle des outils et met en cache les invites (prompts), dans le but de réduire la latence pour le codage et les flux de travail d'agents.

Points forts

  • MiniMax affirme que la version highspeed produit les mêmes résultats que M2.5 tout en générant plus rapidement.
  • M2.5 cible le codage, l'appel d'outils et la recherche, ainsi que le travail de productivité bureautique.
  • Le raisonnement, l'utilisation d'outils et la mise en cache des invites sont tous disponibles.
  • Les poids de M2.5 sont publiés ouvertement, ce qui permet de vérifier le comportement par rapport à une copie auto-hébergée.

Quand préférer un autre modèle

  • Entrée textuelle uniquement ; les diagrammes et les photos doivent donc être décrits par des mots.
  • Pas de mode de schéma de réponse, contrairement à M2.1 ; la sortie structurée repose sur l'invitation (prompting) et la validation dans votre code.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

Tarification

Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.

Spécification par défaut

Par 1M Token
Prix Official
Entrée $0.60 / Sortie $2.40 / Lecture cache $0.03 / Jetons d'écriture cache $0.375
Prix Verified
—
Remise
—
Tarification du cache de prompt

Lecture cache

Prix Official
$0.03
Prix Verified
—
Remise
—

Jetons d'écriture cache

Prix Official
$0.375
Prix Verified
—
Remise
—

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez MiniMax-M2.5-highspeed dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester minimax-m2.5-highspeed avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

  • Agents de codage à faible latence

    Maintenez un agent réactif pendant qu'il lit des fichiers, exécute des commandes et révise son plan.

  • Pipelines de recherche et d'outils

    Enchaînez des outils Web ou de base de données où chaque étape du modèle attend un résultat de récupération.

  • Automatisation des tâches de bureau

    Rédigez et révisez des feuilles de calcul, des rapports ou du texte de diapositives lorsque plusieurs cycles rapides sont nécessaires.

Exemples de prompts

Recherchez dans le dépôt chaque utilisation du client obsolète, listez les fichiers et corrigez les plus simples.

Résumez les tickets de ce trimestre par thème, puis rédigez trois points clés pour une mise à jour hebdomadaire.

Appelez lookup_price pour chaque SKU de la liste et signalez ceux qui ont changé.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

En quoi M2.5-highspeed diffère-t-il de M2.5 ?

MiniMax décrit les deux comme identiques en termes de capacités, ne différant que par la vitesse. Utilisez la version highspeed lorsque le délai entre les étapes est important dans une boucle interactive ou un agent.

Pour quoi M2.5 a-t-il été conçu ?

La note de version de MiniMax indique qu'il a atteint des résultats de premier plan en programmation, en appel d'outils, en recherche et en productivité bureautique. Il s'agit d'un modèle d'agent généraliste plutôt que d'un modèle dédié uniquement au codage.

Prend-il en charge la sortie de schéma JSON structuré ?

Aucun schéma de réponse n'est proposé pour ce modèle, bien que l'utilisation d'outils soit prise en charge. Si vous avez besoin d'une sortie strictement typée, validez-la dans votre code ou utilisez M2.1, qui dispose d'une sortie de schéma.

Est-il open source ?

Les poids de M2.5 sont publiés sur Hugging Face sous MiniMaxAI. Le nom highspeed fait référence à la manière dont le modèle est servi et à la rapidité avec laquelle il répond, et non à un modèle différent.

Dois-je utiliser M2.5-highspeed ou M2.7-highspeed ?

Essayez M2.7-highspeed pour les nouvelles fonctionnalités d'agent telles que les compétences et la recherche d'outils dynamique. Gardez M2.5-highspeed si vos invites sont optimisées pour celui-ci et que les résultats sont stables.

Combien coûte MiniMax-M2.5-highspeed ?

Sur TokenLab, MiniMax-M2.5-highspeed coûte Entrée $0.60 / Sortie $2.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de MiniMax-M2.5-highspeed ?

MiniMax-M2.5-highspeed accepte jusqu'à 204 800 jetons de contexte et génère jusqu'à 65 536 jetons par réponse.

Quel endpoint MiniMax-M2.5-highspeed doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour MiniMax-M2.5-highspeed. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations MiniMax-M2.5-highspeed prend-il en charge ?

MiniMax-M2.5-highspeed prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer MiniMax-M2.5-highspeed

Sources

Mis à jour le 2 oct. 2026

Plus de la série MiniMax

Modèles associés