Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

MiniMax: MiniMax-M2.1-highspeed

MiniMax M2.1 Highspeed adalah model yang berfokus pada kecepatan untuk tugas pengodean dan tugas berbantuan alat. Model ini berguna untuk loop agen interaktif di mana aplikasi bergantian antara instruksi yang dihasilkan, hasil alat, dan respons berikutnya.
Bandingkan model
minimax-m2.1-highspeed
TersediaMiniMaxObrolan
Masukan / Keluaran
$0.60 / $2.40
Konteks
205K
Output maksimal
128K
Modalitas
Obrolan
Kapabilitas
Penggunaan toolCache Prompt

Tentang MiniMax-M2.1-highspeed

MiniMax-M2.1-highspeed adalah versi yang berfokus pada kecepatan dari model M2.1 MiniMax untuk tugas pengodean dan tugas yang dibantu alat. Model ini cocok untuk loop agen interaktif di mana aplikasi bergantian antara instruksi yang dihasilkan, hasil alat, dan respons berikutnya. Model ini mempertahankan penalaran, penggunaan alat, mode JSON, dan output skema dari M2.1, tanpa mengorbankan fitur apa pun demi giliran yang lebih cepat.

Kelebihan

  • Ditujukan untuk loop di mana model menjawab, alat berjalan, dan model menjawab lagi, sehingga penundaan setiap giliran akan terakumulasi.
  • Mempertahankan mode JSON dan output dengan batasan skema dari M2.1.
  • Penalaran tersedia saat langkah membutuhkannya.
  • Penggunaan alat dan caching prompt keduanya didukung.

Kapan harus beralih

  • Hanya teks; tangkapan layar dan gambar lainnya tidak dapat dikirim.
  • M2.5-highspeed dan M2.7-highspeed adalah varian cepat yang lebih baru dan mungkin lebih cocok untuk build baru.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksResponses API
    POST/v1/responses
    Format API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.1-highspeed",
        "input": "Hello!"
      }'

Penetapan Harga

Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.

Spesifikasi default

per 1M token
Harga Official
Masukan $0.60 / Keluaran $2.40 / Pembacaan cache $0.03 / Penulisan cache $0.375
Harga Verified
—
Diskon
—
Harga cache prompt

Pembacaan cache

Harga Official
$0.03
Harga Verified
—
Diskon
—

Penulisan cache

Harga Official
$0.375
Harga Verified
—
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka MiniMax-M2.1-highspeed di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba minimax-m2.1-highspeed dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

  • Asisten pengodean interaktif

    Menjalankan pembantu dalam editor yang harus membalas dengan cepat setiap instruksi saat membaca dan mengedit file.

  • Loop agen dengan banyak langkah singkat

    Menjalankan siklus rencana, panggil alat, baca hasil di mana latensi model mendominasi total waktu tugas.

  • Respons terstruktur dalam aplikasi langsung

    Mengembalikan JSON yang valid secara skema ke front end yang menunggu balasan.

Contoh prompt

Buka utils/date.ts, temukan bug zona waktu, dan perbaiki. Kemudian jalankan pengujian dan laporkan hanya kegagalannya.

Diberikan hasil alat ini, tentukan tindakan tunggal berikutnya dan keluarkan sebagai JSON dengan bidang action dan args.

Ubah nama fungsi di seluruh file yang tercantum dan tunjukkan diff untuk masing-masing.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa versi highspeed dari MiniMax-M2.1?

Ini adalah generasi M2.1 yang sama yang disajikan sebagai opsi yang berfokus pada kecepatan untuk tugas pengodean dan tugas yang dibantu alat. Pilih ini saat penundaan antar langkah agen interaktif menjadi penting.

Apakah model ini kehilangan fitur dibandingkan dengan M2.1?

Tidak. Model ini mempertahankan rangkaian fitur M2.1 yaitu penalaran, penggunaan alat, caching prompt, mode JSON, dan skema respons, sehingga perubahannya ada pada kecepatan giliran. Kualitas pada tugas Anda sendiri tetap layak untuk diuji.

Bisakah saya menggunakannya untuk output terstruktur?

Ya. Mode JSON dan skema respons keduanya ditandai sebagai didukung, sehingga Anda dapat meminta output dalam bentuk tetap dan mengurainya di aplikasi Anda.

Apakah ada model MiniMax cepat yang lebih baru?

Ya. MiniMax kemudian merilis M2.5-highspeed dan M2.7-highspeed sebagai opsi yang lebih cepat. Bandingkan keduanya pada tugas Anda sendiri jika Anda memulai proyek baru alih-alih mempertahankan integrasi yang sudah ada.

Apakah model ini mendukung gambar?

Tidak. Model ini tidak memiliki input gambar, jadi hanya membaca dan menulis teks. Pilih MiniMax M3 saat prompt memerlukan pemahaman gambar atau video. Prompt teks dan hasil alat adalah satu-satunya input yang diterima.

Berapa biaya MiniMax-M2.1-highspeed?

Di TokenLab, MiniMax-M2.1-highspeed dikenakan Masukan $0.60 / Keluaran $2.40 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output MiniMax-M2.1-highspeed?

MiniMax-M2.1-highspeed mendukung hingga 204.800 token konteks dan menghasilkan hingga 131.072 token per respons.

Endpoint mana yang harus digunakan MiniMax-M2.1-highspeed?

Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk MiniMax-M2.1-highspeed. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung MiniMax-M2.1-highspeed?

MiniMax-M2.1-highspeed mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan MiniMax-M2.1-highspeed

Sumber

Ditinjau 2 Okt 2026

Lainnya dari MiniMax

Model terkait