Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

MiniMax: MiniMax-M2.5-highspeed

High-Speed MiniMax-Modell für Coding- und Agenten-Workflows mit geringer Latenz
Modelle vergleichen
minimax-m2.5-highspeed
VerfügbarMiniMaxUnterhaltung
Eingabe / Ausgabe
$0.60 / $2.40
Kontext
205K
Maximale Ausgabe
64K
Modalitäten
Unterhaltung
Funktionen
Tool-NutzungPrompt-Cache

Über MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed ist die schnellere Serving-Option von MiniMax-M2.5, dem Modell vom Februar 2026, das für Programmierung, Tool-Calling, Suche und Büroproduktivität optimiert wurde. MiniMax gibt an, dass M2.5 und seine Highspeed-Version identische Ergebnisse liefern, wobei die Highspeed-Variante schneller läuft. Es schlussfolgert, ruft Tools auf und nutzt Prompt-Caching, mit dem Ziel, Latenzzeiten bei Coding- und Agent-Workflows zu minimieren.

Stärken

  • MiniMax gibt an, dass die Highspeed-Version die Ergebnisse von M2.5 erreicht, während sie schneller generiert.
  • M2.5 ist auf Programmierung, Tool-Calling und Suche sowie auf Büroproduktivitätsaufgaben ausgerichtet.
  • Schlussfolgerung (Reasoning), Tool-Nutzung und Prompt-Caching sind verfügbar.
  • Die Gewichte von M2.5 sind offen veröffentlicht, sodass das Verhalten anhand einer selbst gehosteten Kopie überprüft werden kann.

Alternativen

  • Nur Texteingabe; Diagramme und Fotos müssen daher in Worten beschrieben werden.
  • Kein Response-Schema-Modus, anders als bei M2.1; strukturierte Ausgaben basieren auf Prompting und Validierung in Ihrem Code.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextResponses API
    POST/v1/responses
    API-Format:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

Preise

Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.

Standardspezifikation

Pro 1M Token
Official-Preis
Eingabe $0.60 / Ausgabe $2.40 / Cache-Lesevorgang $0.03 / Cache-Schreibvorgang $0.375
Verified-Preis
—
Rabatt
—
Prompt-Cache-Preise

Cache-Lesevorgang

Official-Preis
$0.03
Verified-Preis
—
Rabatt
—

Cache-Schreibvorgang

Official-Preis
$0.375
Verified-Preis
—
Rabatt
—

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Metriken erscheinen, sobald die Schwellenwerte für Datenschutz und Datenvolumen erreicht sind.

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne MiniMax-M2.5-highspeed in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste minimax-m2.5-highspeed mit einer kurzen Nachricht an /v1/responses. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

  • Coding-Agenten mit geringer Latenz

    Halten Sie einen Agenten reaktionsfähig, während er Dateien liest, Befehle ausführt und seinen Plan überarbeitet.

  • Such- und Tool-Pipelines

    Verketten Sie Web- oder Datenbank-Tools, bei denen jeder Modellschritt auf ein Abfrageergebnis wartet.

  • Automatisierung von Büroaufgaben

    Entwerfen und überarbeiten Sie Tabellenkalkulationen, Berichte oder Folientexte, bei denen mehrere schnelle Durchläufe erforderlich sind.

Prompt-Beispiele

Durchsuchen Sie das Repository nach jeder Verwendung des veralteten Clients, listen Sie die Dateien auf und patchen Sie die einfachsten davon.

Fassen Sie die Tickets dieses Quartals nach Themen zusammen und entwerfen Sie dann drei Stichpunkte für ein wöchentliches Update.

Rufen Sie lookup_price für jede SKU in der Liste auf und melden Sie alle, die sich geändert haben.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Wie unterscheidet sich M2.5-highspeed von M2.5?

MiniMax beschreibt beide als funktional identisch, wobei sie sich nur in der Geschwindigkeit unterscheiden. Verwenden Sie die Highspeed-Version, wenn die Verzögerung zwischen den Schritten in einer interaktiven Schleife oder einem Agenten wichtig ist.

Wofür wurde M2.5 entwickelt?

Die Release-Notes von MiniMax besagen, dass es führende Ergebnisse in den Bereichen Programmierung, Tool-Calling, Suche und Büroproduktivität erzielt hat. Es ist ein allgemeines Agentenmodell und kein reines Coding-Modell.

Unterstützt es strukturierte JSON-Schema-Ausgaben?

Für dieses Modell wird kein Response-Schema angeboten, obwohl die Tool-Nutzung unterstützt wird. Wenn Sie eine strikt typisierte Ausgabe benötigen, validieren Sie diese in Ihrem Code oder verwenden Sie M2.1, das über eine Schema-Ausgabe verfügt.

Ist es Open Source?

Die M2.5-Gewichte sind auf Hugging Face unter MiniMaxAI veröffentlicht. Der Name „highspeed“ bezieht sich darauf, wie das Modell bereitgestellt wird und wie schnell es antwortet, nicht auf ein anderes Modell.

Sollte ich M2.5-highspeed oder M2.7-highspeed verwenden?

Probieren Sie M2.7-highspeed für neuere Agentenfunktionen wie Skills und dynamische Tool-Suche aus. Behalten Sie M2.5-highspeed bei, wenn Ihre Prompts darauf abgestimmt sind und die Ergebnisse stabil sind.

Was kostet MiniMax-M2.5-highspeed?

Auf TokenLab kostet MiniMax-M2.5-highspeed Eingabe $0.60 / Ausgabe $2.40 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed verarbeitet bis zu 204.800 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.

Welchen Endpunkt soll MiniMax-M2.5-highspeed verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/responses für MiniMax-M2.5-highspeed. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

MiniMax-M2.5-highspeed vergleichen

Quellen

Geprüft am 02.10.2026

Mehr aus der MiniMax-Serie

Ähnliche Modelle