Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Anthropic: Claude Haiku 5.5

Model Claude tercepat, dirancang untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi seperti klasifikasi, ekstraksi, perutean, dan tugas subagen.
Bandingkan model
claude-haiku-5-5
TersediaAnthropicObrolanInput cache 90% lebih hematBaru
Masukan / Keluaran-70%
$0.10 / $0.50$0.03 / $0.15
Konteks
1M
Dirilis
7 Okt 2026
Output maksimal
128K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache PromptPenalaran

Tentang Claude Haiku 5.5

Claude Haiku 5.5 adalah model Claude yang kecil dan cepat dari Anthropic, dirilis pada 7 Oktober 2026 untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi seperti klasifikasi, ekstraksi, perutean, dan tugas subagen. Ini adalah Haiku pertama dengan upaya (effort) yang dapat disesuaikan, sehingga satu model dapat menjawab permintaan sederhana dengan cepat dan berpikir lebih lama pada permintaan yang lebih sulit. Anthropic menyebutnya sebagai model tercepat mereka pada kecepatan standar, dengan batas pengetahuan hingga Juni 2026.

Kelebihan

  • Anthropic menyebutnya sebagai model tercepat mereka pada kecepatan standar, yang cocok untuk dukungan pelanggan langsung dan penggunaan peramban.
  • Ini adalah Haiku pertama dengan tingkat upaya, sehingga satu model dapat melayani obrolan cepat dan tugas agen yang lebih panjang.
  • Anthropic melaporkan peningkatan besar dibandingkan Haiku 4.5 pada tolok ukur termasuk OSWorld 2.1, GDPval-AA, dan Terminal-Bench 4.0.
  • Model ini menerima input teks dan gambar serta bekerja sebagai subagen di samping Opus 5.5 atau Sonnet 5.5 dalam pekerjaan pengodean, menurut Anthropic.
  • Pemikiran adaptif aktif secara default, dan pengaturan upaya mengontrol seberapa banyak model berpikir.

Kapan harus beralih

  • Anthropic menyatakan bahwa Sonnet 5.5 dan Opus 5.5 tetap menjadi pilihan yang lebih baik untuk pengodean agen yang kompleks dan pekerjaan yang bersifat terbuka.
  • Pengklasifikasi keamanan dapat menolak permintaan dengan alasan penghentian penolakan, dan perlindungan keamanan siber tetap memblokir pengujian penetrasi.
  • Anggaran pemikiran manual tidak didukung; pemikiran adaptif dengan pengaturan upaya menggantikannya.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksMessages API
    POST/v1/messages
    Format API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-5-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Penetapan Harga

Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.

Masukan token <= 100K

per 1M token
Harga Official
Masukan $0.10 / Keluaran $0.50 / Pembacaan cache $0.01 / Penulisan cache $0.125
Harga TokenLab
Masukan $0.03 / Keluaran $0.15 / Pembacaan cache $0.003 / Penulisan cache $0.0375
Diskon
-70%

Masukan token 100K-1M

per 1M token
Harga Official
Masukan $0.50 / Keluaran $2.50 / Pembacaan cache $0.05 / Penulisan cache $0.625
Harga TokenLab
Masukan $0.15 / Keluaran $0.75 / Pembacaan cache $0.015 / Penulisan cache $0.1875
Diskon
-70%
Harga cache prompt

Pembacaan cache

Harga Official
$0.01
Harga TokenLab
$0.003
Diskon
-70%

Penulisan cache

Harga Official
$0.125
Harga TokenLab
$0.0375
Diskon
-70%
Biaya alat

Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.

Pencarian web

Harga Official
$0.01/pencarian
Harga TokenLab
$0.003/pencarian
Diskon
-70%

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Claude Haiku 5.5 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba claude-haiku-5-5 dengan pesan singkat di /v1/messages. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Penalaran
  • Visi
  • Klasifikasi dan perutean bervolume tinggi

    Melabeli tiket, merutekan permintaan, dan menarik kolom dari dokumen dalam volume besar, di mana kecepatan respons dan throughput yang stabil adalah yang terpenting.

  • Subagen dalam alur kerja pengodean

    Menjalankan tugas sampingan yang sempit seperti mencari basis kode atau meringkas file saat model yang lebih besar memimpin pekerjaan tersebut, sebuah pasangan yang disorot oleh Anthropic.

  • Dukungan langsung dan tugas peramban

    Menjawab pelanggan secara waktu nyata atau mengarahkan langkah peramban dari tangkapan layar, di mana waktu tunggu antar giliran membentuk pengalaman pengguna.

  • Ringkasan dan pemadatan

    Meringkas percakapan, pengajuan, atau log yang panjang menjadi ringkasan singkat, dan memadatkan konteks agen di antara langkah-langkah.

Contoh prompt

Klasifikasikan masing-masing dari 50 tiket dukungan ini sebagai penagihan, bug, atau permintaan fitur, dan kembalikan daftar JSON dengan ID tiket dan kategorinya.

Baca pengajuan ini dan tarik nama perusahaan, tahun fiskal, pendapatan, dan laba bersih ke dalam tabel. Tandai nilai apa pun yang tidak dapat Anda temukan.

Ringkas percakapan ini sejauh ini dalam enam poin yang mencakup setiap keputusan, pertanyaan terbuka, dan nama file, agar agen baru dapat melanjutkan pekerjaan tersebut.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa keunggulan utama Claude Haiku 5.5?

Pekerjaan dengan cakupan sempit dan bervolume tinggi: klasifikasi, ekstraksi, perutean, ringkasan, pemadatan, dan tugas subagen. Anthropic memasarkannya sebagai model tercepat mereka dan menyatakan bahwa Sonnet 5.5 atau Opus 5.5 tetap lebih baik untuk pengodean agen yang kompleks.

Tingkat upaya mana yang harus saya mulai pada Haiku 5.5?

Anthropic merekomendasikan medium, yaitu pengaturan default, untuk sebagian besar pekerjaan termasuk pengodean agen. Gunakan low untuk obrolan, tugas alat singkat, dan permintaan bervolume tinggi yang sederhana, meskipun dalam perintah agen yang panjang, model mungkin melewatkan pencarian atau berhenti lebih awal. Gunakan high untuk kepatuhan instruksi yang ketat, dan xhigh atau max hanya jika pengujian Anda sendiri menunjukkan adanya peningkatan.

Bisakah saya mematikan pemikiran pada Haiku 5.5?

Sebagian. Pemikiran bersifat adaptif dan aktif secara default. Mengirimkan permintaan dengan pemikiran dinonaktifkan akan bekerja pada upaya low, medium, dan high, serta mengembalikan kesalahan pada xhigh dan max. Cara yang disukai Anthropic untuk mendapatkan pemikiran yang lebih sedikit adalah dengan tingkat upaya yang lebih rendah. Pemikiran dihitung terhadap batas output, jadi sisakan ruang untuk itu.

Apa perbedaan Haiku 5.5 dengan Haiku 4.5?

Anthropic melaporkan peningkatan tolok ukur yang besar, jendela konteks dan batas output yang lebih panjang, upaya yang dapat disesuaikan, dan pemikiran adaptif sebagai pengganti anggaran pemikiran manual. Model ini menggunakan tokenizer yang lebih baru, sehingga teks yang sama dihitung sebagai lebih banyak token, dan pengklasifikasi keamanannya dapat mengembalikan penolakan yang tidak dilakukan oleh Haiku 4.5.

Kapan saya harus memilih Sonnet 5.5 daripada Haiku 5.5?

Pilih Sonnet 5.5 atau Opus 5.5 untuk pengodean agen yang kompleks, sesi terminal yang panjang, dan tugas yang memerlukan penilaian berkelanjutan, di mana Anthropic menyatakan bahwa model tersebut tetap lebih kuat. Pilih Haiku 5.5 ketika kecepatan dan volume yang penting serta tugasnya memiliki cakupan sempit, seperti klasifikasi, ringkasan, atau pekerjaan subagen.

Berapa biaya Claude Haiku 5.5?

Di TokenLab, Claude Haiku 5.5 dikenakan Masukan $0.03 / Keluaran $0.15 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output Claude Haiku 5.5?

Claude Haiku 5.5 mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 128.000 token per respons.

Endpoint mana yang harus digunakan Claude Haiku 5.5?

Pakai https://api.tokenlab.sh/v1/messages sebagai default untuk Claude Haiku 5.5. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Claude Haiku 5.5?

Claude Haiku 5.5 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Claude Haiku 5.5

Sumber

Ditinjau 8 Okt 2026

Lainnya dari Claude 5

Model terkait