Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

MiniMax: MiniMax-M3

Model multimodal MiniMax untuk pengodean konteks panjang, persepsi, dan perencanaan agen
Bandingkan model
minimax-m3
TersediaMiniMaxObrolan
Masukan / Keluaran
$0.30 / $1.20
Konteks
1M
Output maksimal
512K
Modalitas
Obrolan
Kapabilitas
Penggunaan toolCache Prompt

Tentang MiniMax-M3

MiniMax-M3 adalah model open-weight dari MiniMax yang dirilis pada Juni 2026 untuk tugas pengodean, pekerjaan agen, dan konteks panjang. Model ini menggunakan MiniMax Sparse Attention agar input yang sangat panjang tetap terjangkau, melakukan penalaran sebelum menjawab, memanggil alat, dan melakukan caching pada prompt. Ini adalah model seri M terdepan dari perusahaan tersebut dan penerus dari M2.7.

Kelebihan

  • MiniMax Sparse Attention mengurangi komputasi per-token pada input yang sangat panjang dibandingkan dengan generasi sebelumnya.
  • Menargetkan dekomposisi tugas otonom, pemanggilan alat, dan penalaran multi-langkah untuk agen.
  • Bobot terbuka (open weights) dipublikasikan oleh MiniMax, sehingga perilaku model dapat diperiksa melalui salinan yang di-host sendiri.
  • Penalaran, penggunaan alat, dan caching prompt semuanya dapat diaktifkan untuk loop agen yang panjang.

Kapan harus beralih

  • Hanya input teks, sehingga bagan dan tangkapan layar tidak dapat dibaca secara langsung.
  • Penalaran dan input yang sangat panjang membuat permintaan lebih lambat dibandingkan model M2.x berkecepatan tinggi.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksResponses API
    POST/v1/responses
    Format API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m3",
        "input": "Hello!"
      }'

Penetapan Harga

Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.

Masukan token <= 512K

per 1M token
Harga Official
Masukan $0.30 / Keluaran $1.20 / Pembacaan cache $0.06
Harga Verified
—
Diskon
—

Masukan token > 512K

per 1M token
Harga Official
Masukan $0.60 / Keluaran $2.40 / Pembacaan cache $0.12
Harga Verified
—
Diskon
—
Harga cache prompt

Pembacaan cache

Harga Official
$0.06
Harga Verified
—
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Tingkat keberhasilan 30 hari
100,0%
Permintaan 30 hari
100+
Aktivitas terakhir
kemarin dulu

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka MiniMax-M3 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba minimax-m3 dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

  • Pekerjaan seluruh repositori

    Muat basis kode yang besar dan minta model untuk melacak perubahan di seluruh modul sebelum melakukan pengeditan.

  • Agen perencanaan

    Berikan serangkaian alat dan tujuan kepada agen, lalu biarkan agen tersebut menguraikan tugas dan memanggil alat langkah demi langkah.

  • Analisis dokumen panjang

    Tinjau transkrip, spesifikasi, atau dokumen pengajuan yang panjang dalam satu kali proses alih-alih memecahnya menjadi bagian-bagian kecil.

Contoh prompt

Ini adalah repositori lengkapnya. Di mana logika percobaan ulang (retry logic) diimplementasikan, dan apa yang rusak jika saya mengubah backoff-nya?

Ini adalah linimasa insiden dan log layanan. Tulis langkah-langkah untuk mereproduksi bug tersebut dan sebutkan modul yang kemungkinan besar rusak.

Rencanakan cara membagi monolit ini menjadi tiga layanan, dan sebutkan panggilan alat pertama yang akan Anda buat untuk masing-masing layanan.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa yang membuat MiniMax-M3 berbeda dari M2.7?

MiniMax menghadirkan M3 sebagai generasi baru yang dibangun dengan sparse attention untuk konteks yang sangat panjang dan ditujukan untuk tugas pengodean serta agen, di mana M2.7 menargetkan rangkaian agen yang lebih awal.

Apakah MiniMax-M3 memiliki bobot terbuka (open weight)?

MiniMax memublikasikan M3 sebagai model open-weight, sehingga Anda dapat melakukan hosting sendiri jika aturan data Anda mengharuskannya. Baca lisensi pada kartu model sebelum melakukannya.

Apakah model ini menerima gambar dan video?

Tidak. MiniMax-M3 hanya menerima input teks, jadi gunakan model dengan input gambar jika Anda perlu membaca tangkapan layar, bagan, diagram, atau bingkai video secara langsung.

Bisakah model ini menggunakan alat?

Ya. Model ini memanggil alat, dan MiniMax mengarahkannya pada perencanaan agen, di mana tugas dipecah menjadi beberapa langkah dan alat dipanggil di setiap langkah. Sertakan definisi alat Anda bersama permintaan dan biarkan model memutuskan kapan harus memanggilnya.

Kapan saya harus menggunakan M3 dibandingkan model M2.x berkecepatan tinggi?

Pilih M3 untuk input yang sangat panjang atau perencanaan agen yang lebih sulit. Pilih varian M2.x berkecepatan tinggi ketika penundaan setiap giliran lebih penting daripada kedalaman penalaran.

Berapa biaya MiniMax-M3?

Di TokenLab, MiniMax-M3 dikenakan Masukan $0.30 / Keluaran $1.20 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output MiniMax-M3?

MiniMax-M3 mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 524.288 token per respons.

Endpoint mana yang harus digunakan MiniMax-M3?

Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk MiniMax-M3. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung MiniMax-M3?

MiniMax-M3 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan MiniMax-M3

Sumber

Ditinjau 2 Okt 2026

Lainnya dari MiniMax

Model terkait