Moonshot: Kimi K3
kimi-k3- Masukan / Keluaran
- $3.00 / $15.00
- Konteks
- 1M
- Output maksimal
- 128K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang Kimi K3
Kimi K3 adalah model unggulan open-weight milik Moonshot AI yang dirilis pada Juli 2026: model mixture-of-experts dengan 2,8 triliun parameter, input gambar dan video asli, serta konteks satu juta token. Fitur berpikir selalu aktif dengan upaya rendah, tinggi, atau maksimal. Model ini menggunakan Kimi Delta Attention dan mengaktifkan 16 dari 896 pakar per token. Moonshot membangunnya untuk agen jangka panjang, basis kode besar, dan pekerjaan berbasis pengetahuan.
Kelebihan
- Upaya penalaran dapat diatur ke rendah, tinggi, atau maksimal, sehingga satu model mencakup jawaban cepat dan pemecahan masalah mendalam.
- Konteks satu juta token, ditujukan untuk basis kode besar dan riwayat agen yang panjang.
- Input gambar dan video asli, sehingga grafik, tangkapan layar, dan rekaman dapat menjadi bagian dari tugas.
- Mendukung output JSON, pemanggilan alat dengan pemuatan dinamis, kelanjutan awalan, dan caching konteks otomatis.
Kapan harus beralih
- Fitur berpikir selalu aktif, sehingga putaran sepele memakan waktu lebih lama daripada model tanpa fitur berpikir.
- Model dengan ukuran ini berat untuk di-host sendiri meskipun bobotnya terbuka.
- Teks adalah satu-satunya output; gunakan model terpisah untuk gambar atau ucapan.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "kimi-k3", "input": "Hello!" }'
Penetapan Harga
Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.
Default
per 1M token- Harga Official
- Masukan $3.00 / Keluaran $15.00 / Pembacaan cache $0.30 / Penulisan cache $3.00 / Teks Masukan $3.00 / Teks Keluaran $15.00
- Harga Verified
- —
- Diskon
- —
Pembacaan cache
- Harga Official
- $0.30
- Harga Verified
- —
- Diskon
- —
Penulisan cache
- Harga Official
- $3.00
- Harga Verified
- —
- Diskon
- —
| Harga Officialper 1M token | Harga Verifiedper 1M token | Diskon | |
|---|---|---|---|
| Default | Masukan $3.00 / Keluaran $15.00 / Pembacaan cache $0.30 / Penulisan cache $3.00 / Teks Masukan $3.00 / Teks Keluaran $15.00 | — | — |
| Harga cache prompt | |||
| Pembacaan cache | $0.30 | — | — |
| Penulisan cache | $3.00 | — | — |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
- Tingkat keberhasilan 30 hari
- 98,8%
- Permintaan 30 hari
- 100+
- Aktivitas terakhir
- 9 menit yang lalu
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Kimi K3 di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba kimi-k3 dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
- Visi
Agen jangka panjang
Jalankan agen riset atau teknik yang melakukan ratusan pemanggilan alat dan perlu mengingat hasil sebelumnya di sepanjang sesi yang sangat panjang.
Pekerjaan basis kode besar
Navigasikan dan ubah repositori besar dengan memuat sebagian besar ke dalam konteks daripada hanya mengandalkan pengambilan data.
Analisis video dan grafik
Ajukan pertanyaan tentang demo rekaman atau grafik padat dan terima temuan yang mengutip apa yang ada di layar.
Otomatisasi pekerjaan pengetahuan
Susun laporan dan analisis dari kumpulan dokumen besar, menggunakan alat untuk mengambil data dan memeriksa angka.
Contoh prompt
Tinjau dokumen 600 halaman yang dilampirkan dan buat daftar setiap transaksi pihak terkait beserta nomor halamannya.
Baca repositori ini dan jelaskan bagaimana permintaan mengalir dari router ke basis data, sebutkan setiap file.
Tonton video demo produk ini dan tulis laporan bug untuk langkah di mana formulir diatur ulang.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa itu Kimi K3?
Model unggulan open-weight milik Moonshot AI, dengan 2,8 triliun parameter dalam desain mixture-of-experts. Model ini membaca teks, gambar, dan video, memiliki konteks satu juta token, dan berpikir sebelum menjawab dengan upaya yang dapat disesuaikan.
Apa saja tingkat upaya penalaran?
Rendah, tinggi, dan maksimal. Fitur berpikir selalu aktif, dan upaya menentukan seberapa banyak model mempertimbangkan. Gunakan rendah untuk permintaan rutin dan maksimal untuk debugging, perencanaan, atau analisis yang sulit.
Apakah Kimi K3 open source?
Moonshot menerbitkan bobotnya setelah peluncuran API, sehingga Anda dapat melakukan hosting sendiri jika memiliki perangkat kerasnya. Memanggilnya melalui API menghindari biaya tersebut dan memungkinkan Anda beralih model tanpa melakukan redeploy.
Apakah mendukung input video?
Ya. Moonshot menjelaskan dukungan asli untuk gambar dan video, yang cocok untuk rekaman layar, demo, dan grafik bersama instruksi teks. Outputnya tetap teks, sehingga temuan kembali sebagai jawaban tertulis.
Apa bedanya dengan Kimi K2.6?
K3 adalah model yang lebih baru dan jauh lebih besar, dengan jendela satu juta token, tingkat upaya yang dapat dikonfigurasi, dan penskalaan yang lebih efisien menurut Moonshot. K2.6 memiliki konteks yang lebih pendek dan tidak memiliki pengaturan upaya.
Berapa biaya Kimi K3?
Di TokenLab, Kimi K3 dikenakan Masukan $3.00 / Keluaran $15.00 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Kimi K3?
Kimi K3 mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 131.072 token per respons.
Endpoint mana yang harus digunakan Kimi K3?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk Kimi K3. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Kimi K3?
Kimi K3 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Kimi K3
Sumber
Ditinjau 2 Okt 2026