OpenAI: GPT-5 mini
gpt-5-mini- Masukan / Keluaran-30%
- $0.25 / $2.00$0.175 / $1.40
- Konteks
- 400K
- Output maksimal
- 128K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang GPT-5 mini
GPT-5 mini adalah model GPT-5 OpenAI yang lebih kecil, dideskripsikan sebagai versi GPT-5 yang lebih cepat dan hemat biaya untuk pekerjaan yang terdefinisi dengan baik dan ber-throughput tinggi. Model ini menerima teks dan gambar, mengembalikan teks, serta mempertahankan token penalaran, pemanggilan fungsi, dan output terstruktur. Pilih model ini daripada model penuh ketika latensi dan volume lebih penting daripada akurasi puncak.
Kelebihan
- Diposisikan oleh OpenAI sebagai versi GPT-5 yang lebih cepat untuk aplikasi yang sensitif terhadap waktu dan ber-throughput tinggi.
- Mempertahankan token penalaran, sehingga masih dapat mengerjakan masalah multi-langkah dalam skala yang lebih kecil.
- Menangani pemanggilan fungsi, pencarian web, pencarian file, dan output terstruktur seperti model saudaranya yang lebih besar.
- Menerima input gambar, yang memungkinkan pertanyaan tentang tangkapan layar dan dokumen tanpa model visi terpisah.
Kapan harus beralih
- Batas pengetahuannya pada Mei 2024 lebih awal daripada GPT-5 penuh, sehingga model ini tahu lebih sedikit tentang peristiwa terkini.
- Pada penalaran tersulit dan refaktor besar, GPT-5 penuh atau tingkat Pro adalah pilihan yang lebih aman.
- Model ini hanya mengembalikan teks, tanpa output audio atau gambar.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
Penetapan Harga
Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.
Spesifikasi default
per 1M token- Harga Official
- Masukan $0.25 / Keluaran $2.00 / Pembacaan cache $0.025
- Harga Verified
- Masukan $0.175 / Keluaran $1.40 / Pembacaan cache $0.0175
- Diskon
- -30%
Pembacaan cache
- Harga Official
- $0.025
- Harga Verified
- $0.0175
- Diskon
- -30%
Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.
Pencarian web
- Harga Official
- $0.01/pencarian
- Harga Verified
- $0.007/pencarian
- Diskon
- -30%
| Harga Officialper 1M token | Harga Verifiedper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $0.25 / Keluaran $2.00 / Pembacaan cache $0.025 | Masukan $0.175 / Keluaran $1.40 / Pembacaan cache $0.0175 | -30% |
| Harga cache prompt | |||
| Pembacaan cache | $0.025 | $0.0175 | -30% |
| Biaya alatBiaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut. | |||
| Pencarian web | $0.01/pencarian | $0.007/pencarian | -30% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka GPT-5 mini di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba gpt-5-mini dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
- Visi
Asisten yang berhadapan dengan pelanggan
Menjawab pertanyaan produk dengan panggilan alat ke sistem pemesanan di mana waktu respons menentukan pengalaman pengguna.
Klasifikasi batch
Melabeli ribuan tiket atau ulasan dengan skema output terstruktur dan kategori yang konsisten.
Penjelasan kode dan pengeditan kecil
Menjelaskan fungsi, menulis tes, dan melakukan pengeditan terbatas ketika model ukuran penuh melebihi kebutuhan tugas.
Sub-langkah agen
Menjalankan pencarian rutin dan ringkasan di dalam alur kerja yang lebih besar sementara model yang lebih kuat menangani perencanaan.
Contoh prompt
Klasifikasikan tiket dukungan ini sebagai penagihan, bug, atau permintaan fitur dan kembalikan label dengan satu kalimat penalaran.
Ringkas transkrip panggilan ini dalam lima poin dan daftar item tindakan apa pun beserta pemiliknya.
Tulis unit test untuk fungsi ini dan tunjukkan input apa pun yang gagal ditangani.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa itu GPT-5 mini?
GPT-5 mini adalah versi GPT-5 yang lebih kecil dari OpenAI. Model ini ditujukan untuk pekerjaan yang cepat dan hemat biaya dengan volume permintaan tinggi, serta tetap mendukung penalaran, alat, dan input gambar.
Kapan saya harus menggunakan GPT-5 mini daripada GPT-5?
Gunakan mini untuk tugas-tugas dengan cakupan yang jelas seperti klasifikasi, peringkasan, dan panggilan alat rutin di mana kecepatan dan volume sangat berarti. Gunakan GPT-5 penuh ketika jawaban terlalu sering salah pada set evaluasi Anda sendiri atau tugas memerlukan penalaran yang lebih dalam.
Apakah GPT-5 mini menerima gambar?
Ya. Teks dan gambar masuk dan teks keluar. Itu mencakup pembacaan tangkapan layar, formulir, dan bagan untuk pertanyaan atau ekstraksi, tetapi model tidak dapat membuat atau mengedit gambar itu sendiri.
Apa batas pengetahuan GPT-5 mini?
OpenAI mencantumkan 31 Mei 2024 sebagai batas pengetahuan untuk model ini. Apa pun yang lebih baru harus berasal dari prompt, dari file yang dilampirkan, atau dari panggilan alat pencarian web.
Apakah GPT-5 mini lebih kecil daripada GPT-5 nano?
Tidak. Nano adalah yang lebih kecil dan lebih murah dari keduanya dan ditujukan untuk peringkasan dan klasifikasi. Mini berada di antara nano dan GPT-5 penuh dalam hal kapabilitas dan biaya.
Berapa biaya GPT-5 mini?
Di TokenLab, GPT-5 mini dikenakan Masukan $0.175 / Keluaran $1.40 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output GPT-5 mini?
GPT-5 mini mendukung hingga 400.000 token konteks dan menghasilkan hingga 128.000 token per respons.
Endpoint mana yang harus digunakan GPT-5 mini?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk GPT-5 mini. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung GPT-5 mini?
GPT-5 mini mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan GPT-5 mini
Sumber
Ditinjau 2 Okt 2026