Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Anthropic: Claude Haiku 4.5

Jalur Claude cepat untuk agen ringan, tugas kantor, dan obrolan yang responsif
Bandingkan model
claude-haiku-4-5
TersediaAnthropicObrolanInput cache 90% lebih hemat
Masukan / Keluaran-70%
$1.00 / $5.00$0.30 / $1.50
Konteks
200K
Output maksimal
64K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache PromptPenalaran

Tentang Claude Haiku 4.5

Claude Haiku 4.5 adalah model Claude berukuran kecil dan cepat dari Anthropic, yang dirilis pada Oktober 2025 untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi. Anthropic menggambarkannya sebagai model tercepat dalam jajarannya dengan kecerdasan mendekati tingkat terdepan (near-frontier). Model ini menerima teks dan gambar, mendukung penggunaan alat (tool use) dan penembolokan prompt (prompt caching), serta menggunakan pemikiran terperinci manual dengan anggaran token alih-alih pemikiran adaptif dari model Claude yang lebih baru.

Kelebihan

  • Latensi terendah di antara model Claude yang tercantum di halaman ringkasan Anthropic, yang cocok untuk front-end obrolan dan asisten waktu nyata.
  • Membaca gambar di sebelah teks, sehingga model ini dapat mengklasifikasikan tangkapan layar, tanda terima, dan grafik dalam volume besar.
  • Pemikiran terperinci bersifat opsional dan diatur dengan anggaran token yang eksplisit, sehingga Anda menentukan per permintaan berapa banyak penalaran yang ingin dibayar.
  • Mendukung penggunaan alat, keluaran JSON terstruktur, dan penembolokan prompt, yang menjaga prompt sistem berulang tetap murah dalam perulangan agen.

Kapan harus beralih

  • Batas pengetahuan model ini jauh lebih awal daripada generasi Claude 5, sehingga model ini tahu lebih sedikit tentang pustaka dan peristiwa terbaru.
  • Model ini memiliki jendela konteks dan batas keluaran yang lebih kecil daripada model Opus dan Sonnet 5.x, yang membatasi pekerjaan berskala seluruh repositori atau sepanjang buku.
  • Untuk proses pengkodean otonom yang panjang atau perencanaan multi-langkah yang ambisius, model Sonnet atau Opus lebih jarang mengalami kegagalan.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksMessages API
    POST/v1/messages
    Format API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Penetapan Harga

Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.

Spesifikasi default

per 1M token
Harga Official
Masukan $1.00 / Keluaran $5.00 / Pembacaan cache $0.10 / Penulisan cache $1.25
Harga TokenLab
Masukan $0.30 / Keluaran $1.50 / Pembacaan cache $0.03 / Penulisan cache $0.375
Diskon
-70%
Harga cache prompt

Pembacaan cache

Harga Official
$0.10
Harga TokenLab
$0.03
Diskon
-70%

Penulisan cache

Harga Official
$1.25
Harga TokenLab
$0.375
Diskon
-70%
Biaya alat

Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.

Pencarian web

Harga Official
$0.01/pencarian
Harga TokenLab
$0.003/pencarian
Diskon
-70%

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Tingkat keberhasilan 30 hari
100,0%
Latensi median 7 hari
916 msn=273
Latensi P95 7 hari
16 sn=273
Permintaan 30 hari
100+
Aktivitas terakhir
15 menit yang lalu

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Claude Haiku 4.5 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba claude-haiku-4-5 dengan pesan singkat di /v1/messages. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Penalaran
  • Visi
  • Obrolan dan dukungan waktu nyata

    Tempatkan model di balik widget yang menghadap pelanggan di mana kecepatan balasan lebih penting daripada kedalaman, dengan pemanggilan alat untuk pencarian pesanan dan pengalihan manual saat pertanyaan menjadi sulit.

  • Klasifikasi dan ekstraksi

    Beri tag pada tiket, ambil kolom dari faktur atau tangkapan layar, dan kembalikan JSON ketat untuk alur kerja hilir yang berjalan ribuan kali sehari.

  • Pekerja sub-agen

    Jalankan model sebagai pekerja berbiaya rendah dalam pengaturan multi-agen: model yang lebih besar merencanakan, dan beberapa pemanggilan Haiku mencari, meringkas, atau memeriksa file secara paralel.

Contoh prompt

Klasifikasikan email dukungan ini sebagai penagihan, bug, permintaan fitur, atau lainnya, dan kembalikan JSON dengan label beserta alasan satu kalimat.

Ringkas transkrip obrolan ini dalam tiga poin dan cantumkan setiap item tindakan beserta pemiliknya.

Lihat tangkapan layar dialog kesalahan ini dan beri tahu saya pengaturan mana yang harus diubah pengguna.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Untuk apa Claude Haiku 4.5 paling cocok digunakan?

Pekerjaan cepat dan bervolume tinggi: asisten obrolan, klasifikasi, ekstraksi data, peringkasan, dan agen pekerja. Anthropic menempatkannya sebagai model Claude tercepat dengan kecerdasan mendekati tingkat terdepan, sehingga menjadi pilihan default saat waktu respons dan throughput lebih penting daripada penalaran terdalam.

Apakah Claude Haiku 4.5 mendukung pemikiran terperinci (extended thinking)?

Ya, tetapi dalam bentuk manual: Anda mengaktifkan pemikiran dan menetapkan anggaran token. Model ini tidak menggunakan mode pemikiran adaptif atau parameter upaya yang digunakan oleh model Sonnet dan Opus yang lebih baru, sehingga Anda mengontrol kedalaman penalaran melalui anggaran yang Anda berikan.

Apakah Claude Haiku 4.5 dapat memproses gambar?

Ya. Model ini menerima gambar beserta teks dan menjawab dalam bentuk teks. Hal itu mencakup pembacaan tangkapan layar, grafik, dan dokumen yang dipindai. Model ini tidak dapat menghasilkan atau mengedit gambar, jadi gunakan model gambar saat Anda memerlukan keluaran gambar.

Kapan saya harus beralih dari Haiku 4.5 ke Sonnet?

Beralihlah ketika Haiku melewatkan instruksi pada prompt yang panjang, melewatkan langkah dalam menjalankan agen multi-alat, atau memerlukan pengetahuan tentang rilisan terbaru. Sonnet 5.5 adalah langkah berikutnya dan tetap mempertahankan profil cepat, dengan jendela konteks yang lebih panjang dan batas pengetahuan yang jauh lebih baru.

Berapa biaya Claude Haiku 4.5?

Di TokenLab, Claude Haiku 4.5 dikenakan Masukan $0.30 / Keluaran $1.50 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output Claude Haiku 4.5?

Claude Haiku 4.5 mendukung hingga 200.000 token konteks dan menghasilkan hingga 64.000 token per respons.

Endpoint mana yang harus digunakan Claude Haiku 4.5?

Pakai https://api.tokenlab.sh/v1/messages sebagai default untuk Claude Haiku 4.5. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Claude Haiku 4.5?

Claude Haiku 4.5 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Claude Haiku 4.5

Panduan menggunakan Claude Haiku 4.5

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Claude 4

Model terkait