Untuk sebagian besar pekerjaan interaktif mandiri, pilihan antara langganan Claude dan API tidaklah sulit: langganan biasanya lebih unggul. Untuk pipeline otomatis, produk multi-pengguna, atau volume coding harian yang tinggi, API sering kali lebih unggul setelah volume token melewati ambang batas yang dapat Anda hitung. Kami memperbarui analisis ini pada 19-09-2026 karena harga perkenalan Sonnet 5 berakhir pada 31 Agustus 2026. Tarif standar Sonnet 5 dari Anthropic mulai 1 September 2026 adalah $3/MTok input, $15/MTok output, dan $0,30/MTok untuk cache hit. Snapshot sumber asli menggunakan tarif perkenalan $2/$10/$0,20 dan menunjukkan alur kerja moderat sekitar $9-12/bulan serta alur kerja berat sekitar $102 tanpa cache atau $70-100+/bulan. Kami menampilkan kedua snapshot, perhitungan tarif standar, dan rumus titik impas di bawah ini. Kami juga menandai apa yang tidak dapat diverifikasi dari bukti publik saat ini: harga langganan yang tepat dan jumlah tunjangan token batas tarif Pro yang tepat.
Poin Utama
- Harga API standar Claude Sonnet 5 mulai 1 Sep 2026: $3/MTok input, $15/MTok output, $0,30/MTok cache hits. Tarif perkenalan asli hingga 31 Agustus 2026 adalah $2/$10/$0,20. Sumber: Dokumentasi harga Anthropic, diamati 09-07-2026; tanggal pembaruan 19-09-2026.
- Biaya cache hits adalah $0,30/MTok vs $3/MTok untuk input baru pada harga standar Sonnet 5. Itu adalah pengurangan 90% pada bagian token input. Token output tidak di-cache, jadi penghematan tagihan total lebih kecil. Contoh yang kami kerjakan menunjukkan penghematan 23-28%.
- Harga batch menurunkan Sonnet 5 menjadi $1/MTok input, $5/MTok output hingga 31 Agustus 2026. Ini hanya berlaku untuk pekerjaan async dan non-interaktif, bukan sesi coding langsung. Karena jendela tersebut telah berlalu, konfirmasikan tarif batch saat ini sebelum mengandalkannya.
- Alur kerja coding harian moderat pada API menelan biaya sekitar $18,48/bulan pada tarif standar Sonnet 5 tanpa caching. Dengan asumsi cache hit 60%, biayanya turun menjadi sekitar $14,20/bulan. Snapshot tarif perkenalan asli adalah sekitar $9-12/bulan.
- Alur kerja berat menelan biaya sekitar $153,45/bulan tanpa cache pada tarif standar, atau $110,68 dengan cache hit 60%. Snapshot sumber asli menunjukkan sekitar $102 tanpa cache dan $70-100+/bulan tergantung pada asumsi.
- Anthropic tidak mempublikasikan jumlah token atau pesan tetap untuk jendela batas tarif paket Pro dalam kumpulan bukti ini. Periksa indikator penggunaan langsung Anda di Claude.ai atau Claude Code untuk mengetahui tunjangan Anda saat ini. Bukti sumber juga tidak menyertakan harga bulanan Pro/Max. Konfirmasikan di halaman paket Anthropic Anda sebelum menggunakan tabel titik impas.
Langganan Claude vs API: Tarif
Bukti sumber untuk analisis ini berasal dari dua tempat: dokumentasi harga resmi Anthropic dan katalog langsung TokenLab. Keduanya memiliki tanggal pengamatan.
| Sumber | Cakupan | Diamati pada |
|---|---|---|
| Dokumentasi harga Platform Claude | Tarif per-token dan batch resmi Claude Sonnet 5, Opus 4.8, Fable 5 | 09-07-2026 |
| Bukti model/harga langsung TokenLab | Tarif katalog TokenLab untuk model Claude dan penyedia alternatif | 07-07-2026 |
Harga API Claude Resmi (Anthropic)
| Model | Input $/MTok | Output $/MTok | Cache hit $/MTok | Konteks | Sumber | Diamati |
|---|---|---|---|---|---|---|
| Claude Sonnet 5 (perkenalan, hingga 31 Agt 2026) | $2,00 | $10,00 | $0,20 | 1M | Dokumentasi harga Anthropic | 09-07-2026 |
| Claude Sonnet 5 (standar, mulai 1 Sep 2026) | $3,00 | $15,00 | $0,30 | 1M | Dokumentasi harga Anthropic | 09-07-2026 |
| Claude Sonnet 5 (batch, hingga 31 Agt 2026, hanya async) | $1,00 | $5,00 | n/a | 1M | Dokumentasi harga Anthropic | 09-07-2026 |
| Claude Opus 4.8 | $5,00 | $25,00 | $0,50 | 1M | Dokumentasi harga Anthropic | 09-07-2026 |
| Claude Fable 5 | $10,00 | $50,00 | $1,00 | 1M | Dokumentasi harga Anthropic | 09-07-2026 |
Ini hanya tarif API per-token. Harga bulanan langganan Pro/Max Anthropic bukan bagian dari kumpulan bukti ini. Periksa halaman paket akun Anda sebelum menjalankan perhitungan titik impas di bawah ini.
TokenLab merutekan permintaan melalui Claude Sonnet 5 dan alternatif berbiaya lebih rendah dari satu kunci API. Hal itu memungkinkan Anda menguji apakah model yang lebih murah memenuhi standar kualitas Anda sebelum berkomitmen pada integrasi API Anthropic langsung atau kursi langganan Max. Katalog langsung TokenLab mencantumkan harga model saat ini di halaman model TokenLab.
Harga Katalog TokenLab: Claude vs Alternatif Berbiaya Lebih Rendah
Hanya model yang ada dalam bukti harga langsung TokenLab yang tercantum di sini.
| Model | Penyedia | Input $/MTok | Output $/MTok | Konteks | Sumber | Diamati |
|---|---|---|---|---|---|---|
| Claude Sonnet 5 | anthropic | $2,00 | $10,00 | 1.000.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| Claude Opus 4.8 | anthropic | $5,00 | $25,00 | 1.000.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| Claude Fable 5 | anthropic | $10,00 | $50,00 | 1.000.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| GPT-5.5 | openai | $5,00 | $30,00 | 1.050.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| GPT-5.5 Batch/Flex | openai | $2,50 | $15,00 | 1.050.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| Gemini 3.5 Flash | $1,50 | $9,00 | 1.048.576 | Bukti harga langsung TokenLab | 07-07-2026 | |
| GLM-5.2 | z-ai | $0,93 | $3,00 | 1.048.576 | Bukti harga langsung TokenLab | 07-07-2026 |
| Kimi K2.7 Code | moonshotai | $0,74 | $3,50 | 262.144 | Bukti harga langsung TokenLab | 07-07-2026 |
| Qwen3.7 Plus | qwen | $0,32 | $1,28 | 1.000.000 | Bukti harga langsung TokenLab | 07-07-2026 |
| MiniMax M3 | minimax | $0,30 | $1,20 | 1.048.576 | Bukti harga langsung TokenLab | 07-07-2026 |
| DeepSeek V4 Pro | deepseek | $0,435 | $0,87 | 1.048.576 | Bukti harga langsung TokenLab | 07-07-2026 |
| DeepSeek V4 Flash | deepseek | $0,09 | $0,18 | 1.048.576 | Bukti harga langsung TokenLab | 07-07-2026 |
Pada tarif katalog TokenLab saat ini, Claude Sonnet 5 2-6x lebih mahal per token daripada DeepSeek V4 Pro, GLM-5.2, atau Qwen3.7 Plus. Jika beban kerja Anda tidak memerlukan Claude secara khusus, memeriksa model berbiaya lebih rendah terhadap standar kualitas Anda terlebih dahulu dapat mengubah seluruh keputusan langganan-vs-API. Peringkat model murah TokenLab ada di halaman peringkat TokenLab.
Contoh Kerja: Biaya Alur Kerja Coding Harian pada API
Skenario di bawah ini menggunakan asumsi volume permintaan dan ukuran token. Skenario ini diberi label sebagai asumsi, bukan penggunaan terukur. Kami mengujinya terhadap tarif standar dan tarif perkenalan Claude Sonnet 5 dari Anthropic. Sesuaikan input agar sesuai dengan log Anda sendiri.
Penghitungan ulang tarif standar (mulai 1 September 2026): Ini menggunakan tarif standar Sonnet 5 sebesar $3/$15/$0,30.
Asumsi alur kerja ringan: 40 permintaan/hari, rata-rata 3.000 token input, rata-rata 800 token output, 22 hari kerja/bulan.
| Metrik | Nilai |
|---|---|
| Token input bulanan | 2,64M |
| Token output bulanan | 0,704M |
| Biaya, tanpa caching | $7,92 (input) + $10,56 (output) = $18,48 |
| Biaya, asumsi cache hit 60% pada input | $0,48 (di-cache) + $3,17 (baru) + $10,56 (output) = $14,20 |
| Penghematan caching | $4,28/bulan, pengurangan 23,1% pada skenario ini |
Asumsi alur kerja berat: 150 permintaan/hari, rata-rata 8.000 token input, rata-rata 1.500 token output, 22 hari kerja/bulan.
| Metrik | Nilai |
|---|---|
| Token input bulanan | 26,4M |
| Token output bulanan | 4,95M |
| Biaya, tanpa caching | $79,20 (input) + $74,25 (output) = $153,45 |
| Biaya, asumsi cache hit 60% pada input | $4,75 (di-cache) + $31,68 (baru) + $74,25 (output) = $110,68 |
| Penghematan caching | $42,77/bulan, pengurangan 27,9% pada skenario ini |
Snapshot tarif perkenalan asli: Ini adalah contoh kerja artikel sumber hingga 31 Agustus 2026.
Asumsi alur kerja ringan: 40 permintaan/hari, rata-rata 3.000 token input, rata-rata 800 token output, 22 hari kerja/bulan.
| Metrik | Nilai |
|---|---|
| Token input bulanan | 2,64M |
| Token output bulanan | 0,704M |
| Biaya, tanpa caching | $5,28 (input) + $7,04 (output) = $12,32 |
| Biaya, asumsi cache hit 60% pada input | $0,32 (di-cache) + $2,11 (baru) + $7,04 (output) = $9,47 |
| Penghematan caching | $2,85/bulan, pengurangan 23,1% pada skenario ini |
Asumsi alur kerja berat: 150 permintaan/hari, rata-rata 8.000 token input, rata-rata 1.500 token output, 22 hari kerja/bulan.
| Metrik | Nilai |
|---|---|
| Token input bulanan | 26,4M |
| Token output bulanan | 4,95M |
| Biaya, tanpa caching | $52,80 (input) + $49,50 (output) = $102,30 |
| Biaya, asumsi cache hit 60% pada input | $3,17 (di-cache) + $21,12 (baru) + $49,50 (output) = $73,79 |
| Penghematan caching | $28,51/bulan, pengurangan 27,9% pada skenario ini |
Sebagai contoh, alur kerja ringan mengasumsikan 40 permintaan/hari, rata-rata 3.000 token input, rata-rata 800 token output, dan 22 hari kerja/bulan. Kami melihat bahwa token output tidak pernah di-cache dalam model ini, jadi penghematan caching selalu lebih rendah daripada tingkat diskon input-saja sebesar 90%. Asumsi cache hit 60% bersifat ilustratif, bukan terukur. Rasio cache hit nyata Anda bergantung pada seberapa banyak setiap permintaan menggunakan kembali perintah sistem statis, konteks file, atau skema alat dibandingkan dengan konten baru.
Matematika Titik Impas: Token API vs Harga Langganan
Untuk menemukan volume token yang tepat di mana biaya API sama dengan harga langganan Anda, Anda memerlukan dua angka. Pertama, harga langganan bulanan Anda ada di halaman paket akun Anthropic Anda. Itu tidak termasuk dalam kumpulan bukti ini. Kedua, Anda memerlukan tarif $/MTok campuran berdasarkan campuran input:output Anda.
Tarif campuran = (pangsa input x $3) + (pangsa output x $15), menggunakan harga standar Sonnet 5 mulai 1 September 2026.
Bukti sumber tidak menyertakan harga bulanan Pro/Max Anthropic. Jika halaman paket Anda menunjukkan $20/bulan, misalnya, kalikan token titik impas per angka $1 dengan 20. Konfirmasikan harga saat ini di halaman paket Anda sebelum menggunakannya.
Tabel titik impas tarif standar (mulai 1 September 2026):
| Campuran input:output | $/MTok campuran | Token titik impas per $1 harga langganan |
|---|---|---|
| 90:10 (padat konteks, jawaban singkat) | $4,20 | 238.095 |
| 70:30 (asisten coding tipikal) | $6,60 | 151.515 |
| 50:50 (obrolan seimbang) | $9,00 | 111.111 |
| 30:70 (generasi bentuk panjang) | $11,40 | 87.719 |
Tabel titik impas tarif perkenalan asli:
| Campuran input:output | $/MTok campuran | Token titik impas per $1 harga langganan |
|---|---|---|
| 90:10 (padat konteks, jawaban singkat) | $2,80 | 357.143 |
| 70:30 (asisten coding tipikal) | $4,40 | 227.273 |
| 50:50 (obrolan seimbang) | $6,00 | 166.667 |
| 30:70 (generasi bentuk panjang) | $7,60 | 131.579 |
Kami menjalankan matematika titik impas dengan tarif perkenalan Sonnet 5 yang dipublikasikan Anthropic. Pada campuran 70:30, setiap $10 harga langganan sama dengan sekitar 2,27M token campuran penggunaan API Sonnet 5 pada harga perkenalan. Di bawah tarif standar, $10 yang sama sama dengan sekitar 1,52M token campuran. Jika volume token bulanan aktual Anda untuk pekerjaan yang setara melebihi angka tersebut, API memakan biaya lebih tinggi untuk pekerjaan yang sama daripada langganan. Di bawahnya, langganan kemungkinan lebih murah, dengan asumsi Anda tetap berada di dalam jendela batas tarif.
Keterbatasan dalam Kumpulan Bukti Ini
- Harga langganan tidak diverifikasi. Harga langganan bulanan Pro/Max Anthropic tidak disertakan dalam bukti harga yang digunakan untuk artikel ini. Periksa halaman paket akun Anda sebelum menjalankan rumus titik impas di atas.
- Tunjangan token batas tarif tidak dipublikasikan sebagai angka tetap. Anthropic menegakkan penggunaan melalui jendela bergulir, yang biasanya digambarkan sekitar lima jam. Jumlah token atau pesan tepat yang disertakan bervariasi berdasarkan model, tingkat akun, dan panjang percakapan. Tidak ada angka terverifikasi tunggal yang tersedia dalam kumpulan bukti ini. Periksa indikator penggunaan langsung di Claude.ai atau Claude Code untuk tunjangan Anda saat ini.
- Rasio cache hit dalam contoh kerja adalah asumsi (60%), bukan tingkat produksi terukur. Rasio nyata sepenuhnya bergantung pada seberapa banyak setiap permintaan merupakan konteks statis yang digunakan kembali.
- Contoh harga batch hanya untuk referensi. Ini tidak berlaku untuk sesi coding interaktif karena pekerjaan batch bersifat async secara desain.
- Penghitungan ulang tarif standar adalah milik kami, berdasarkan tarif standar yang dipublikasikan Anthropic mulai 1 September 2026. Snapshot sumber asli tetap pada 09-07-2026 untuk tarif perkenalan.
Dalam pipeline kami, kami memperlakukan asumsi cache hit 60% sebagai input perencanaan, bukan tingkat terukur.
Langganan Claude vs API: Kapan Masing-masing Pihak Menang
Kapan Langganan Menang
- Penggunaan mandiri di dalam Claude.ai atau Claude Code, tanpa perlu memanggil model dari backend Anda sendiri.
- Volume penggunaan yang tetap berada di bawah jendela batas tarif paket Anda tanpa luapan reguler.
- Tidak diperlukan akses terprogram. Jika Anda tidak menulis kode yang memanggil API, penagihan langganan lebih mudah dianggarkan.
- Tim di mana setiap orang bekerja secara independen di dalam antarmuka Claude, dan harga per-kursi lebih mudah direncanakan daripada konsumsi token agregat di seluruh kunci API bersama.
Kapan API Menang
- Pipeline otomatis: ringkasan batch, pemrosesan dokumen, atau alur kerja agen yang berjalan tanpa manusia di dalam loop. Tidak ada tingkat langganan untuk itu.
- Produk multi-pengguna: alat SaaS apa pun di mana pengguna akhir memicu panggilan model memerlukan pengukuran per-token, yang hanya diekspos oleh API.
- Volume di atas titik impas yang Anda hitung, di mana penagihan per-token memakan biaya lebih sedikit daripada langganan tetap untuk pekerjaan yang setara.
- Blok konteks besar yang berulang, di mana cache hit pada $0,30/MTok pada tarif standar secara material memotong bagian token input dari tagihan. Tarif perkenalan sumber adalah $0,20/MTok.
- Pekerjaan non-real-time yang memenuhi syarat untuk harga batch pada $1/$5 per MTok hingga 31 Agustus 2026. Konfirmasikan tarif batch saat ini karena jendela tersebut telah berlalu.
Daftar Periksa Praktis dan Pertimbangan Multi-Model
- Apakah Anda perlu memanggil model dari backend Anda sendiri, atau hanya melalui antarmuka Claude sendiri?
- Sudahkah Anda mencatat jumlah token input dan output bulanan Anda yang sebenarnya, atau Anda masih memperkirakan?
- Sudahkah Anda menjalankan rumus titik impas di atas menggunakan harga langganan nyata Anda?
- Apakah beban kerja Anda mengulangi blok konteks statis besar yang dapat memperoleh manfaat dari tarif standar cache hit $0,30/MTok?
- Bisakah bagian mana pun dari beban kerja Anda berjalan secara asinkron dan memenuhi syarat untuk harga batch?
- Sudahkah Anda membandingkan Claude Sonnet 5 dengan model katalog berbiaya lebih rendah untuk tugas khusus ini? Perbandingan harga TokenLab ada di perbandingan harga TokenLab.
- Sudahkah Anda memeriksa apakah DeepSeek V4 Pro, GLM-5.2, atau Qwen3.7 Plus memenuhi standar kualitas Anda dengan sebagian kecil dari biaya? Daftar model murah TokenLab ada di daftar model murah TokenLab.
Langganan Claude hanya mencakup kemampuan teks dan coding Claude sendiri di dalam Claude.ai dan Claude Code. Jika alur kerja Anda mencakup pembuatan kode, pembuatan gambar, atau pembuatan video, tidak ada yang termasuk dalam harga langganan.
- Untuk beban kerja khusus coding, benchmark Claude Sonnet 5 terhadap DeepSeek V4 Pro, GLM-5.2, Kimi K2.7 Code, atau Gemini 3.5 Flash daripada berasumsi Claude diperlukan. Perbandingan coding TokenLab ada di perbandingan model AI terbaik untuk coding TokenLab.
- Pembuatan gambar adalah API terpisah dan harga terpisah sepenuhnya, tidak tercakup oleh paket Claude mana pun. Perbandingan model gambar TokenLab ada di model AI gambar terbaik untuk akses API.
- Pembuatan video memiliki struktur biayanya sendiri, berbeda dari langganan Claude dan harga API Claude. Perbandingan model video TokenLab ada di model AI video terbaik untuk akses API.
- Jika Anda merutekan di seluruh beberapa penyedia untuk mengoptimalkan biaya per tugas, pendekatan agregator dapat menyederhanakan penagihan. Perbandingan OpenRouter TokenLab mencakup itu di perbandingan OpenRouter TokenLab.
Peringkat TokenLab membandingkan biaya model di seluruh penyedia di halaman peringkat TokenLab.
FAQ
Berapa banyak token yang disertakan dalam langganan Claude Pro?
Anthropic tidak mempublikasikan jumlah token atau pesan universal tetap untuk jendela batas tarif Pro dalam bukti yang digunakan untuk artikel ini. Tunjangan bervariasi berdasarkan model yang dipilih, tingkat akun, dan panjang percakapan. Periksa indikator penggunaan di dalam Claude.ai atau Claude Code untuk tunjangan Anda saat ini dan langsung daripada mengandalkan angka tetap.
Bisakah saya menggunakan langganan Claude Pro/Max saya untuk mengakses API?
Tidak. Langganan mencakup penggunaan di dalam Claude.ai dan Claude Code secara khusus. Akses API ditagih secara terpisah per token dan memerlukan kunci API serta pengaturan penagihan yang terpisah.
Apakah caching prompt tersedia pada paket langganan?
Tidak. Caching adalah mekanisme penagihan khusus API. Cache hit menelan biaya $0,30/MTok dibandingkan $3/MTok untuk token input baru pada harga standar Sonnet 5, pengurangan 90% pada bagian input yang di-cache. Tarif perkenalan sumber adalah $0,20/MTok dibandingkan $2/MTok. Karena langganan tidak menagih per token, tidak ada diskon yang setara. Biaya tetap sudah mencakup penggunaan di dalam batas tarif.
Berapa volume token tepat di mana biaya API sama dengan biaya langganan saya?
Gunakan tabel titik impas tarif standar di atas. Kalikan token titik impas per angka $1 untuk campuran input:output Anda dengan harga langganan bulanan Anda yang sebenarnya. Halaman paket akun Anda memiliki harga tersebut, yang tidak disertakan dalam kumpulan bukti ini. Itu memberikan volume token titik impas pribadi Anda.
Apakah harga batch membantu dengan bantuan coding sehari-hari?
Tidak. Harga batch $1/MTok input dan $5/MTok output hingga 31 Agustus 2026 hanya berlaku untuk pekerjaan async dan non-interaktif. Sesi coding langsung dan obrolan menggunakan tarif per-token standar atau perkenalan. Konfirmasikan tarif batch saat ini karena jendela tersebut telah berlalu.
Jika biaya API Claude yang Anda hitung ternyata lebih tinggi dari yang diharapkan, bandingkan tingkat dan penyedia alternatif sebelum berkomitmen pada arsitektur jangka panjang. Mulailah dengan peringkat TokenLab.
Sumber
Harga diamati pada 2026-07-07
- Claude Platform pricingDiamati pada 2026-07-09
- Anthropic pricingDiamati pada 2026-07-07
- TokenLab cheap models pageDiamati pada 2026-07-07



