Anthropic: Claude Haiku 5.5
claude-haiku-5-5- Masukan / Keluaran-70%
- $0.10 / $0.50$0.03 / $0.15
- Konteks
- 1M
- Dirilis
- 7 Okt 2026
- Output maksimal
- 128K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang Claude Haiku 5.5
Claude Haiku 5.5 adalah model Claude yang kecil dan cepat dari Anthropic, dirilis pada 7 Oktober 2026 untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi seperti klasifikasi, ekstraksi, perutean, dan tugas subagen. Ini adalah Haiku pertama dengan upaya (effort) yang dapat disesuaikan, sehingga satu model dapat menjawab permintaan sederhana dengan cepat dan berpikir lebih lama pada permintaan yang lebih sulit. Anthropic menyebutnya sebagai model tercepat mereka pada kecepatan standar, dengan batas pengetahuan hingga Juni 2026.
Kelebihan
- Anthropic menyebutnya sebagai model tercepat mereka pada kecepatan standar, yang cocok untuk dukungan pelanggan langsung dan penggunaan peramban.
- Ini adalah Haiku pertama dengan tingkat upaya, sehingga satu model dapat melayani obrolan cepat dan tugas agen yang lebih panjang.
- Anthropic melaporkan peningkatan besar dibandingkan Haiku 4.5 pada tolok ukur termasuk OSWorld 2.1, GDPval-AA, dan Terminal-Bench 4.0.
- Model ini menerima input teks dan gambar serta bekerja sebagai subagen di samping Opus 5.5 atau Sonnet 5.5 dalam pekerjaan pengodean, menurut Anthropic.
- Pemikiran adaptif aktif secara default, dan pengaturan upaya mengontrol seberapa banyak model berpikir.
Kapan harus beralih
- Anthropic menyatakan bahwa Sonnet 5.5 dan Opus 5.5 tetap menjadi pilihan yang lebih baik untuk pengodean agen yang kompleks dan pekerjaan yang bersifat terbuka.
- Pengklasifikasi keamanan dapat menolak permintaan dengan alasan penghentian penolakan, dan perlindungan keamanan siber tetap memblokir pengujian penetrasi.
- Anggaran pemikiran manual tidak didukung; pemikiran adaptif dengan pengaturan upaya menggantikannya.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksMessages APIPOST/v1/messagesFormat API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Penetapan Harga
Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.
Masukan token <= 100K
per 1M token- Harga Official
- Masukan $0.10 / Keluaran $0.50 / Pembacaan cache $0.01 / Penulisan cache $0.125
- Harga TokenLab
- Masukan $0.03 / Keluaran $0.15 / Pembacaan cache $0.003 / Penulisan cache $0.0375
- Diskon
- -70%
Masukan token 100K-1M
per 1M token- Harga Official
- Masukan $0.50 / Keluaran $2.50 / Pembacaan cache $0.05 / Penulisan cache $0.625
- Harga TokenLab
- Masukan $0.15 / Keluaran $0.75 / Pembacaan cache $0.015 / Penulisan cache $0.1875
- Diskon
- -70%
Pembacaan cache
- Harga Official
- $0.01
- Harga TokenLab
- $0.003
- Diskon
- -70%
Penulisan cache
- Harga Official
- $0.125
- Harga TokenLab
- $0.0375
- Diskon
- -70%
Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.
Pencarian web
- Harga Official
- $0.01/pencarian
- Harga TokenLab
- $0.003/pencarian
- Diskon
- -70%
| Harga Officialper 1M token | Harga TokenLabper 1M token | Diskon | |
|---|---|---|---|
| Masukan token <= 100K | Masukan $0.10 / Keluaran $0.50 / Pembacaan cache $0.01 / Penulisan cache $0.125 | Masukan $0.03 / Keluaran $0.15 / Pembacaan cache $0.003 / Penulisan cache $0.0375 | -70% |
| Masukan token 100K-1M | Masukan $0.50 / Keluaran $2.50 / Pembacaan cache $0.05 / Penulisan cache $0.625 | Masukan $0.15 / Keluaran $0.75 / Pembacaan cache $0.015 / Penulisan cache $0.1875 | -70% |
| Harga cache prompt | |||
| Pembacaan cache | $0.01 | $0.003 | -70% |
| Penulisan cache | $0.125 | $0.0375 | -70% |
| Biaya alatBiaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut. | |||
| Pencarian web | $0.01/pencarian | $0.003/pencarian | -70% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Claude Haiku 5.5 di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba claude-haiku-5-5 dengan pesan singkat di /v1/messages. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
- Visi
Klasifikasi dan perutean bervolume tinggi
Melabeli tiket, merutekan permintaan, dan menarik kolom dari dokumen dalam volume besar, di mana kecepatan respons dan throughput yang stabil adalah yang terpenting.
Subagen dalam alur kerja pengodean
Menjalankan tugas sampingan yang sempit seperti mencari basis kode atau meringkas file saat model yang lebih besar memimpin pekerjaan tersebut, sebuah pasangan yang disorot oleh Anthropic.
Dukungan langsung dan tugas peramban
Menjawab pelanggan secara waktu nyata atau mengarahkan langkah peramban dari tangkapan layar, di mana waktu tunggu antar giliran membentuk pengalaman pengguna.
Ringkasan dan pemadatan
Meringkas percakapan, pengajuan, atau log yang panjang menjadi ringkasan singkat, dan memadatkan konteks agen di antara langkah-langkah.
Contoh prompt
Klasifikasikan masing-masing dari 50 tiket dukungan ini sebagai penagihan, bug, atau permintaan fitur, dan kembalikan daftar JSON dengan ID tiket dan kategorinya.
Baca pengajuan ini dan tarik nama perusahaan, tahun fiskal, pendapatan, dan laba bersih ke dalam tabel. Tandai nilai apa pun yang tidak dapat Anda temukan.
Ringkas percakapan ini sejauh ini dalam enam poin yang mencakup setiap keputusan, pertanyaan terbuka, dan nama file, agar agen baru dapat melanjutkan pekerjaan tersebut.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa keunggulan utama Claude Haiku 5.5?
Pekerjaan dengan cakupan sempit dan bervolume tinggi: klasifikasi, ekstraksi, perutean, ringkasan, pemadatan, dan tugas subagen. Anthropic memasarkannya sebagai model tercepat mereka dan menyatakan bahwa Sonnet 5.5 atau Opus 5.5 tetap lebih baik untuk pengodean agen yang kompleks.
Tingkat upaya mana yang harus saya mulai pada Haiku 5.5?
Anthropic merekomendasikan medium, yaitu pengaturan default, untuk sebagian besar pekerjaan termasuk pengodean agen. Gunakan low untuk obrolan, tugas alat singkat, dan permintaan bervolume tinggi yang sederhana, meskipun dalam perintah agen yang panjang, model mungkin melewatkan pencarian atau berhenti lebih awal. Gunakan high untuk kepatuhan instruksi yang ketat, dan xhigh atau max hanya jika pengujian Anda sendiri menunjukkan adanya peningkatan.
Bisakah saya mematikan pemikiran pada Haiku 5.5?
Sebagian. Pemikiran bersifat adaptif dan aktif secara default. Mengirimkan permintaan dengan pemikiran dinonaktifkan akan bekerja pada upaya low, medium, dan high, serta mengembalikan kesalahan pada xhigh dan max. Cara yang disukai Anthropic untuk mendapatkan pemikiran yang lebih sedikit adalah dengan tingkat upaya yang lebih rendah. Pemikiran dihitung terhadap batas output, jadi sisakan ruang untuk itu.
Apa perbedaan Haiku 5.5 dengan Haiku 4.5?
Anthropic melaporkan peningkatan tolok ukur yang besar, jendela konteks dan batas output yang lebih panjang, upaya yang dapat disesuaikan, dan pemikiran adaptif sebagai pengganti anggaran pemikiran manual. Model ini menggunakan tokenizer yang lebih baru, sehingga teks yang sama dihitung sebagai lebih banyak token, dan pengklasifikasi keamanannya dapat mengembalikan penolakan yang tidak dilakukan oleh Haiku 4.5.
Kapan saya harus memilih Sonnet 5.5 daripada Haiku 5.5?
Pilih Sonnet 5.5 atau Opus 5.5 untuk pengodean agen yang kompleks, sesi terminal yang panjang, dan tugas yang memerlukan penilaian berkelanjutan, di mana Anthropic menyatakan bahwa model tersebut tetap lebih kuat. Pilih Haiku 5.5 ketika kecepatan dan volume yang penting serta tugasnya memiliki cakupan sempit, seperti klasifikasi, ringkasan, atau pekerjaan subagen.
Berapa biaya Claude Haiku 5.5?
Di TokenLab, Claude Haiku 5.5 dikenakan Masukan $0.03 / Keluaran $0.15 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Claude Haiku 5.5?
Claude Haiku 5.5 mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 128.000 token per respons.
Endpoint mana yang harus digunakan Claude Haiku 5.5?
Pakai https://api.tokenlab.sh/v1/messages sebagai default untuk Claude Haiku 5.5. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Claude Haiku 5.5?
Claude Haiku 5.5 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Claude Haiku 5.5
Sumber
- Introducing Claude Haiku 5.5
- Claude Haiku 5.5 model overview
- What's new in Claude Haiku 5.5
- Prompting Claude Haiku 5.5
Ditinjau 8 Okt 2026