MiniMax: MiniMax-M2.5-highspeed
minimax-m2.5-highspeed- Masukan / Keluaran
- $0.60 / $2.40
- Konteks
- 205K
- Output maksimal
- 64K
- Modalitas
- Obrolan
- Kapabilitas
- Penggunaan toolCache Prompt
Tentang MiniMax-M2.5-highspeed
MiniMax-M2.5-highspeed adalah opsi penyajian yang lebih cepat dari MiniMax-M2.5, model bulan Februari 2026 yang disetel untuk pemrograman, pemanggilan alat (tool calling), pencarian, dan produktivitas kantor. MiniMax menyatakan bahwa M2.5 dan versi highspeed-nya memberikan hasil yang identik, dengan versi highspeed berjalan lebih cepat. Model ini melakukan penalaran, memanggil alat, dan melakukan caching pada prompt, yang ditujukan untuk pengodean latensi rendah dan alur kerja agen.
Kelebihan
- MiniMax mengatakan versi highspeed menyamai hasil M2.5 sembari menghasilkan respons lebih cepat.
- M2.5 menargetkan pengodean, pemanggilan alat, dan pencarian, serta pekerjaan produktivitas kantor.
- Penalaran, penggunaan alat, dan caching prompt semuanya tersedia.
- Bobot M2.5 diterbitkan secara terbuka, sehingga perilakunya dapat diperiksa terhadap salinan yang di-host sendiri.
Kapan harus beralih
- Hanya input teks, jadi diagram dan foto harus dijelaskan dengan kata-kata.
- Tidak ada mode skema respons, tidak seperti M2.1; output terstruktur bergantung pada pemberian prompt dan validasi dalam kode Anda.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
Penetapan Harga
Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.
Spesifikasi default
per 1M token- Harga Official
- Masukan $0.60 / Keluaran $2.40 / Pembacaan cache $0.03 / Penulisan cache $0.375
- Harga Verified
- —
- Diskon
- —
Pembacaan cache
- Harga Official
- $0.03
- Harga Verified
- —
- Diskon
- —
Penulisan cache
- Harga Official
- $0.375
- Harga Verified
- —
- Diskon
- —
| Harga Officialper 1M token | Harga Verifiedper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $0.60 / Keluaran $2.40 / Pembacaan cache $0.03 / Penulisan cache $0.375 | — | — |
| Harga cache prompt | |||
| Pembacaan cache | $0.03 | — | — |
| Penulisan cache | $0.375 | — | — |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka MiniMax-M2.5-highspeed di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba minimax-m2.5-highspeed dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Agen pengodean latensi rendah
Menjaga agen tetap responsif saat membaca file, menjalankan perintah, dan merevisi rencananya.
Pipa pencarian dan alat
Menghubungkan alat web atau basis data di mana setiap langkah model menunggu hasil pengambilan.
Otomatisasi tugas kantor
Menyusun dan merevisi spreadsheet, laporan, atau teks slide di mana beberapa putaran cepat diperlukan.
Contoh prompt
Cari di repositori untuk setiap penggunaan klien yang tidak digunakan lagi (deprecated), buat daftar file, dan perbaiki yang paling sederhana.
Ringkas tiket kuartal ini berdasarkan tema, lalu buat tiga poin untuk pembaruan mingguan.
Panggil lookup_price untuk setiap SKU dalam daftar dan laporkan jika ada yang berubah.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa perbedaan M2.5-highspeed dengan M2.5?
MiniMax mendeskripsikan keduanya identik dalam kemampuan, hanya berbeda dalam kecepatan. Gunakan versi highspeed saat jeda antar langkah penting dalam loop interaktif atau agen.
Untuk apa M2.5 dibuat?
Catatan rilis MiniMax mengatakan model ini mencapai hasil terdepan dalam pemrograman, pemanggilan alat, dan pencarian, serta produktivitas kantor. Ini adalah model agen umum, bukan model khusus pengodean.
Apakah model ini mendukung output skema JSON terstruktur?
Tidak ada skema respons yang ditawarkan untuk model ini, meskipun penggunaan alat didukung. Jika Anda memerlukan output yang diketik secara ketat, validasikan dalam kode Anda atau gunakan M2.1 yang memiliki output skema.
Apakah ini open source?
Bobot M2.5 diterbitkan di Hugging Face di bawah MiniMaxAI. Nama highspeed merujuk pada bagaimana model disajikan dan seberapa cepat model menjawab, bukan pada model yang berbeda.
Haruskah saya menggunakan M2.5-highspeed atau M2.7-highspeed?
Coba M2.7-highspeed untuk fitur agen yang lebih baru seperti keterampilan (skills) dan pencarian alat dinamis. Tetap gunakan M2.5-highspeed jika prompt Anda sudah disetel untuk itu dan hasilnya stabil.
Berapa biaya MiniMax-M2.5-highspeed?
Di TokenLab, MiniMax-M2.5-highspeed dikenakan Masukan $0.60 / Keluaran $2.40 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output MiniMax-M2.5-highspeed?
MiniMax-M2.5-highspeed mendukung hingga 204.800 token konteks dan menghasilkan hingga 65.536 token per respons.
Endpoint mana yang harus digunakan MiniMax-M2.5-highspeed?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk MiniMax-M2.5-highspeed. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung MiniMax-M2.5-highspeed?
MiniMax-M2.5-highspeed mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan MiniMax-M2.5-highspeed
Sumber
Ditinjau 2 Okt 2026