Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

MiniMax: MiniMax-M2.5-highspeed

Model MiniMax berkecepatan tinggi untuk pengodean latensi rendah dan alur kerja agen
Bandingkan model
minimax-m2.5-highspeed
TersediaMiniMaxObrolan
Masukan / Keluaran
$0.60 / $2.40
Konteks
205K
Output maksimal
64K
Modalitas
Obrolan
Kapabilitas
Penggunaan toolCache Prompt

Tentang MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed adalah opsi penyajian yang lebih cepat dari MiniMax-M2.5, model bulan Februari 2026 yang disetel untuk pemrograman, pemanggilan alat (tool calling), pencarian, dan produktivitas kantor. MiniMax menyatakan bahwa M2.5 dan versi highspeed-nya memberikan hasil yang identik, dengan versi highspeed berjalan lebih cepat. Model ini melakukan penalaran, memanggil alat, dan melakukan caching pada prompt, yang ditujukan untuk pengodean latensi rendah dan alur kerja agen.

Kelebihan

  • MiniMax mengatakan versi highspeed menyamai hasil M2.5 sembari menghasilkan respons lebih cepat.
  • M2.5 menargetkan pengodean, pemanggilan alat, dan pencarian, serta pekerjaan produktivitas kantor.
  • Penalaran, penggunaan alat, dan caching prompt semuanya tersedia.
  • Bobot M2.5 diterbitkan secara terbuka, sehingga perilakunya dapat diperiksa terhadap salinan yang di-host sendiri.

Kapan harus beralih

  • Hanya input teks, jadi diagram dan foto harus dijelaskan dengan kata-kata.
  • Tidak ada mode skema respons, tidak seperti M2.1; output terstruktur bergantung pada pemberian prompt dan validasi dalam kode Anda.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksResponses API
    POST/v1/responses
    Format API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

Penetapan Harga

Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.

Spesifikasi default

per 1M token
Harga Official
Masukan $0.60 / Keluaran $2.40 / Pembacaan cache $0.03 / Penulisan cache $0.375
Harga Verified
—
Diskon
—
Harga cache prompt

Pembacaan cache

Harga Official
$0.03
Harga Verified
—
Diskon
—

Penulisan cache

Harga Official
$0.375
Harga Verified
—
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka MiniMax-M2.5-highspeed di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba minimax-m2.5-highspeed dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

  • Agen pengodean latensi rendah

    Menjaga agen tetap responsif saat membaca file, menjalankan perintah, dan merevisi rencananya.

  • Pipa pencarian dan alat

    Menghubungkan alat web atau basis data di mana setiap langkah model menunggu hasil pengambilan.

  • Otomatisasi tugas kantor

    Menyusun dan merevisi spreadsheet, laporan, atau teks slide di mana beberapa putaran cepat diperlukan.

Contoh prompt

Cari di repositori untuk setiap penggunaan klien yang tidak digunakan lagi (deprecated), buat daftar file, dan perbaiki yang paling sederhana.

Ringkas tiket kuartal ini berdasarkan tema, lalu buat tiga poin untuk pembaruan mingguan.

Panggil lookup_price untuk setiap SKU dalam daftar dan laporkan jika ada yang berubah.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa perbedaan M2.5-highspeed dengan M2.5?

MiniMax mendeskripsikan keduanya identik dalam kemampuan, hanya berbeda dalam kecepatan. Gunakan versi highspeed saat jeda antar langkah penting dalam loop interaktif atau agen.

Untuk apa M2.5 dibuat?

Catatan rilis MiniMax mengatakan model ini mencapai hasil terdepan dalam pemrograman, pemanggilan alat, dan pencarian, serta produktivitas kantor. Ini adalah model agen umum, bukan model khusus pengodean.

Apakah model ini mendukung output skema JSON terstruktur?

Tidak ada skema respons yang ditawarkan untuk model ini, meskipun penggunaan alat didukung. Jika Anda memerlukan output yang diketik secara ketat, validasikan dalam kode Anda atau gunakan M2.1 yang memiliki output skema.

Apakah ini open source?

Bobot M2.5 diterbitkan di Hugging Face di bawah MiniMaxAI. Nama highspeed merujuk pada bagaimana model disajikan dan seberapa cepat model menjawab, bukan pada model yang berbeda.

Haruskah saya menggunakan M2.5-highspeed atau M2.7-highspeed?

Coba M2.7-highspeed untuk fitur agen yang lebih baru seperti keterampilan (skills) dan pencarian alat dinamis. Tetap gunakan M2.5-highspeed jika prompt Anda sudah disetel untuk itu dan hasilnya stabil.

Berapa biaya MiniMax-M2.5-highspeed?

Di TokenLab, MiniMax-M2.5-highspeed dikenakan Masukan $0.60 / Keluaran $2.40 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed mendukung hingga 204.800 token konteks dan menghasilkan hingga 65.536 token per respons.

Endpoint mana yang harus digunakan MiniMax-M2.5-highspeed?

Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk MiniMax-M2.5-highspeed. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan MiniMax-M2.5-highspeed

Sumber

Ditinjau 2 Okt 2026

Lainnya dari MiniMax

Model terkait