Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Model AI Murah Terbaik untuk Agen: Biaya dan Mode Kegagalan

·19 September 2026·10 menit baca·Diperbarui 26 September 2026·1516 tampilan
#Agen AI#Optimasi Biaya LLM#Perutean Model#Perangkat Pengembang
Model AI Murah Terbaik untuk Agen: Biaya dan Mode Kegagalan

Dalam pipeline agen kami, model termurah per token jarang menjadi model termurah per tugas yang diselesaikan. Saat kami menguji model AI murah terbaik untuk agen, token output dari pemanggilan alat (tool calls), perbaikan JSON, dan chain-of-thought mendominasi pengeluaran. DeepSeek V4 Flash, Gemini 3.5 Flash, Claude Sonnet 5, GPT-5.5, GLM-5.2, dan Laguna XS 2.1 adalah contoh SSOT (Single Source of Truth) saat ini yang dapat kami bahas. Harga katalog TokenLab di bawah ini diamati pada 2026-09-19; harga eksternal belum memiliki tanggal dan memerlukan konfirmasi penyedia. Kami tidak memublikasikan tolok ukur latensi karena tidak ada dataset TTFT, token/detik, atau tingkat percobaan ulang (retry-rate) yang terkontrol untuk rute-rute ini pada saat penyegaran. Anggap ini sebagai daftar singkat biaya dan mode kegagalan, lalu lakukan tolok ukur latensi di loop Anda sendiri.

Poin Penting

  • Biaya output lebih mendorong pengeluaran agen daripada biaya input. Agen menghasilkan jauh lebih banyak token melalui pemanggilan alat, percobaan ulang, dan JSON daripada yang mereka konsumsi per giliran.
  • Di antara contoh SSOT saat ini dengan harga katalog TokenLab, DeepSeek V4 Flash adalah baris biaya output terendah yang dapat kami verifikasi di sini, yaitu $0,147 input / $0,294 output per MTok.
  • Tabrakan nama model itu nyata. DeepSeek V4 Flash muncul pada dua titik harga: $0,147/$0,294 di katalog TokenLab dan $0,09/$0,18 di daftar eksternal.
  • Harga pembuatan video dan gambar (PixVerse, fal, Black Forest Labs) bukanlah bukti untuk harga token LLM. Hal tersebut tidak boleh muncul sebagai kutipan untuk biaya agen teks, dan kami memisahkannya di bawah.
  • Harga perbandingan eksternal untuk Claude Sonnet 5, GLM-5.2, Kimi K2.7 Code, Qwen3.7 Plus, dan lainnya tidak memiliki URL sumber publik yang bertanggal. Konfirmasikan harga tersebut dengan halaman harga masing-masing penyedia sebelum Anda membuat anggaran.
  • Termurah per token tidak secara otomatis berarti termurah per tugas. Model yang gagal dalam pemanggilan alat atau memotong JSON akan memaksa percobaan ulang, yang menghapus penghematan.

Snapshot Sumber dan Mode Kegagalan

Sumber Jenis Konten Tanggal Diamati Relevansi dengan Artikel Ini
Dokumentasi Platform PixVerse (docs.platform.pixverse.ai) Harga pembuatan video 2026-07-08 Tidak digunakan untuk klaim LLM - khusus video, disertakan untuk transparansi
Halaman model fal PixVerse V6 (fal.ai/pixverse-v6) Harga pembuatan video 2026-07-08 Tidak digunakan untuk klaim LLM - khusus video
Dokumentasi harga Black Forest Labs (docs.bfl.ml) Harga pembuatan gambar 2026-07-08 Tidak digunakan untuk klaim LLM - khusus gambar
Katalog model internal TokenLab Harga LLM & media pihak pertama 2026-09-19 Sumber utama untuk semua harga katalog TokenLab di bawah
Halaman harga penyedia individu (OpenAI, Anthropic, Google, DeepSeek, Moonshot, Qwen, MiniMax, Z.ai) Harga LLM Tidak bertanggal dalam dataset ini Harus diverifikasi secara independen sebelum klaim anggaran publik

Sumber PixVerse, fal, dan BFL ada dalam set penelitian kami karena kami menariknya selama penyisiran harga media yang lebih luas. Mereka menjelaskan penagihan video per detik dan biaya kredit per gambar, yang tidak berpengaruh pada harga LLM per token. Kami mencantumkannya di sini agar pembaca dapat melihat mengapa kami mengecualikannya. Kami tidak menggunakannya untuk klaim LLM.

Dalam pipeline kami, kami mencatat tingkat percobaan ulang pemanggilan alat, JSON yang terpotong, pemanggilan alat yang terlewat, dan argumen fungsi yang berhalusinasi bersama dengan pengeluaran token. Kami tidak memiliki dataset tingkat percobaan ulang yang terkontrol untuk rute-rute ini pada saat penyegaran, jadi kami tidak dapat memublikasikan tingkatannya. Sebagai contoh, model seharga $0,05/MTok yang gagal dalam 15% pemanggilan alat bisa memakan biaya lebih besar dalam percobaan ulang daripada model seharga $1/MTok yang gagal dalam 2%. Matematika mode kegagalan tersebut, bukan harga stiker, yang harus mendorong pilihan tingkat murah Anda.

Perbandingan Model dan Biaya untuk Model AI Murah Terbaik bagi Agen

Semua harga di bawah adalah daftar katalog pihak pertama TokenLab (per token, dinyatakan sebagai $/MTok), yang diamati pada 2026-09-19. Harga tersebut adalah dasar yang benar untuk klaim biaya agen LLM dalam artikel ini.

Model Penyedia Input $/MTok Output $/MTok Kesesuaian Agen
DeepSeek V4 Flash DeepSeek $0,147 $0,294 Opsi SSOT saat ini yang paling murah untuk beban output berat di katalog TokenLab; konfirmasikan ID model yang tepat sebelum membandingkan dengan kutipan eksternal
Gemini 3.5 Flash Google $1,50 $9,00 Langkah agen multimodal (penggunaan alat gambar + teks)
Claude Sonnet 5 Anthropic $2,00 $10,00 Cadangkan untuk verifikasi akhir/tahap QA pada output agen
GPT-5.5 OpenAI $5,00 $30,00 Cadangan untuk perencanaan kompleks atau pemilihan alat yang ambigu
Claude Opus 4.8 Anthropic $5,00 $25,00 Perbandingan unggulan; jarang dibenarkan di dalam loop agen
Claude Fable 5 Anthropic $10,00 $50,00 Batas atas premium
GLM-5.2 Z.ai $0,93 $3,00 Contoh bobot terbuka untuk perutean biaya rendah
Kimi K2.7 Code Moonshot AI $0,74 $3,50 Contoh agen pengodean
Qwen3.7 Plus Alibaba/Qwen $0,32 $1,28 Contoh perutean biaya rendah
MiniMax M3 MiniMax $0,30 $1,20 Contoh perutean biaya rendah
DeepSeek V4 Pro DeepSeek $0,441 $0,882 Subtugas penalaran yang lebih berat dalam keluarga yang sama

Kami menyimpan angka eksternal di bawah untuk kesinambungan audit dan menandai setiap baris sebagai belum diverifikasi. Jangan gunakan angka tersebut untuk penganggaran. Detail yang tepat harus dikonfirmasi terhadap dokumentasi saat ini.

Model Penyedia Input $/MTok Output $/MTok Status Verifikasi
DeepSeek V4 Flash (daftar eksternal) DeepSeek $0,09 $0,18 Berbeda dari katalog TokenLab di atas - konfirmasikan produk/tingkat mana yang dimaksud; tidak ada URL sumber bertanggal dalam set sumber kami
MiniMax M3 MiniMax $0,30 $1,20 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
Qwen3.7 Plus Alibaba/Qwen $0,32 $1,28 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
Kimi K2.7 Code Moonshot AI $0,74 $3,50 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
GLM-5.2 Z.ai $0,93 $3,00 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
Claude Sonnet 5 Anthropic $2,00 $10,00 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
Claude Opus 4.8 Anthropic $5,00 $25,00 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
GPT-5.5 Batch/Flex OpenAI $2,50 $15,00 Tidak ada URL sumber bertanggal dalam set sumber kami; bukan baris GPT-5.5 standar
GPT-5.5 OpenAI $5,00 $30,00 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia
Claude Fable 5 Anthropic $10,00 $50,00 Tidak ada URL sumber bertanggal dalam set sumber kami; konfirmasikan dengan dokumentasi penyedia

Titik harga katalog yang sudah pensiun tidak lagi cocok dengan nama model SSOT saat ini. Kami menyimpan angka-angka tersebut untuk kesinambungan audit, tetapi kami tidak merutekan pekerjaan agen baru ke tingkat yang tidak disebutkan namanya ini tanpa konfirmasi penyedia.

Tingkat pensiun atau non-SSOT Input $/MTok Output $/MTok Status
Tingkat biaya ultra-rendah pensiun $0,05 $0,40 Bukan lagi contoh SSOT saat ini; konfirmasikan penerusnya sebelum digunakan
Tingkat flash-lite biaya rendah pensiun $0,25 $1,50 Bukan lagi contoh SSOT saat ini; petakan ke Gemini 3.5 Flash atau DeepSeek V4 Flash dan konfirmasikan
Tingkat mini biaya rendah pensiun $0,25 $2,00 Bukan lagi contoh SSOT saat ini; petakan ke Claude Sonnet 5 atau DeepSeek V4 Flash dan konfirmasikan
Tingkat validasi kecil pensiun $1,00 $5,00 Bukan lagi contoh SSOT saat ini; petakan ke Claude Sonnet 5 dan konfirmasikan
Tingkat cadangan menengah pensiun $1,25 $10,00 Bukan lagi contoh SSOT saat ini; petakan ke GPT-5.5 dan konfirmasikan
Batas atas premium pensiun $15,00 $120,00 Bukan lagi contoh SSOT saat ini; petakan ke GPT-5.5 atau Claude Fable 5 dan konfirmasikan

Catatan Implementasi untuk Model AI Murah Terbaik bagi Agen

  1. Tingkatkan agen Anda berdasarkan tugas, bukan berdasarkan satu model termurah. Rutekan perutean, klasifikasi, dan pemilihan alat ke DeepSeek V4 Flash atau Gemini 3.5 Flash. Eskalasikan perencanaan multi-langkah ke DeepSeek V4 Pro atau GPT-5.5. Cadangkan Claude Sonnet 5 untuk verifikasi jawaban akhir.
  2. Batasi token output secara agresif pada tingkat murah. Karena biaya output mendominasi pengeluaran agen, tetapkan batas token maksimum yang ketat pada panggilan DeepSeek V4 Flash dan Gemini 3.5 Flash. Hanya izinkan pembuatan yang lebih panjang pada tingkat eskalasi.
  3. Catat mode kegagalan per model, bukan hanya biaya per panggilan. Lacak JSON yang terpotong, pemanggilan alat yang terlewat, dan argumen fungsi yang berhalusinasi secara terpisah dari pengeluaran token. Sebagai contoh, model seharga $0,05/MTok yang gagal dalam 15% pemanggilan alat bisa memakan biaya lebih besar dalam percobaan ulang daripada model seharga $1/MTok yang gagal dalam 2%.
  4. Sematkan ID model yang tepat dalam kode, jangan pernah gunakan alias. Mengingat tabrakan penamaan yang ditunjukkan di atas (dua titik harga DeepSeek V4 Flash yang berbeda), tuliskan string vendor dan model lengkap secara hardcode. Verifikasi ulang harga pada setiap pembaruan penyedia.
  5. Periksa kembali harga eksternal setiap tiga bulan. Apa pun yang tidak memiliki URL sumber bertanggal dalam artikel ini harus ditarik kembali dari halaman harga langsung penyedia sebelum muncul dalam estimasi biaya yang dihadapi pelanggan.

Berikut adalah sketsa perutean yang menggunakan nama model katalog dalam artikel ini. Bentuk permintaan TokenLab dan kolom kesalahan pemanggilan alat yang tepat harus dikonfirmasi dalam dokumentasi API TokenLab sebelum penggunaan produksi.

Sketsa perutean, bukan kontrak API TokenLab. Konfirmasikan bentuk permintaan dalam dokumentasi API TokenLab.
for model in ['DeepSeek V4 Flash', 'Gemini 3.5 Flash', 'Claude Sonnet 5']:
    coba ulang sekali jika pemanggilan alat hilang atau JSON terpotong
    jika respons berisi pemanggilan alat yang valid dan JSON yang valid:
        kembalikan respons
    catat mode kegagalan untuk model ini
timbulkan kesalahan setelah tingkat akhir gagal

Sketsa ini menunjukkan batas percobaan ulang: tangkap kesalahan pemanggilan alat, catat mode kegagalan, lalu pindah ke model berikutnya. Konfirmasikan bentuk permintaan dan kolom kesalahan dalam dokumentasi API TokenLab saat ini sebelum produksi.

Di Mana TokenLab Cocok dengan Perutean Agen

  • Satu katalog mengurangi kerumitan akun per vendor. TokenLab mengekspos tingkat harga OpenAI, Google, Anthropic, dan DeepSeek di bawah satu API dan antarmuka penagihan. Mengalihkan langkah alur kerja dari DeepSeek V4 Flash ke Gemini 3.5 Flash menjadi perubahan konfigurasi, bukan integrasi baru.
  • Harga pihak pertama yang bertanggal dan dapat diaudit. Tidak seperti kutipan pihak ketiga yang tersebar, angka katalog TokenLab dalam artikel ini ditarik dari daftar platform itu sendiri yang diamati pada 2026-09-19. Itulah sebabnya mereka adalah satu-satunya harga di sini yang disajikan tanpa peringatan "harus diverifikasi".
  • Tingkatan bawaan untuk pipeline agen. Karena TokenLab menampung model tingkat murah dan tingkat eskalasi secara berdampingan, Anda dapat melakukan A/B pada biaya dan tingkat kegagalan di seluruh DeepSeek V4 Flash, Gemini 3.5 Flash, dan Claude Sonnet 5. Anda tidak perlu merancang ulang logika perutean agen Anda.

Bacaan Terkait

FAQ

Mengapa saya melihat dua harga untuk DeepSeek V4 Flash?

DeepSeek V4 Flash muncul pada dua titik harga dalam set sumber kami: $0,147/$0,294 di katalog TokenLab dan $0,09/$0,18 di daftar eksternal. Nama model digunakan kembali dan diberi harga ulang di seluruh penyedia dan pengecer. Sematkan vendor dan ID model yang tepat dalam kode, lalu verifikasi ulang terhadap dokumentasi langsung penyedia daripada hanya memercayai nama.

Bisakah saya menggunakan harga referensi eksternal untuk penganggaran?

Belum. Baris-baris tersebut tidak memiliki URL sumber bertanggal dalam set sumber kami, jadi kami menandainya sebagai memerlukan konfirmasi penyedia. Angka katalog TokenLab adalah dasar perencanaan, dan tabel eksternal adalah titik awal untuk verifikasi Anda sendiri, bukan angka final. Detail yang tepat harus dikonfirmasi terhadap dokumentasi saat ini.

Model SSOT saat ini mana yang termurah untuk agen produksi?

Berdasarkan biaya output di antara contoh SSOT saat ini dengan harga katalog TokenLab, DeepSeek V4 Flash adalah yang terendah yang dapat kami verifikasi di sini dengan output $0,294/MTok. Daftar eksternal menunjukkan output $0,18/MTok, tetapi angka tersebut memerlukan konfirmasi penyedia. Ukur yang termurah setelah memperhitungkan tingkat percobaan ulang pada skema pemanggilan alat spesifik Anda.

Mengapa PixVerse, fal, dan BFL dikutip jika artikel ini tentang harga LLM?

Mereka tidak dikutip sebagai bukti untuk klaim harga LLM apa pun. Mereka hanya muncul dalam tabel Snapshot Sumber untuk transparansi mengenai penyisiran penelitian kami yang lebih luas dan secara eksplisit ditandai tidak digunakan untuk klaim LLM. Setiap angka dolar dalam tabel Perbandingan Model dan Biaya berasal dari katalog TokenLab sendiri atau ditandai sebagai belum diverifikasi.

Bagaimana percobaan ulang pemanggilan alat mengubah pilihan model termurah?

Model murah yang gagal dalam pemanggilan alat atau memotong JSON akan memaksa percobaan ulang, dan percobaan ulang tersebut menambah token output. Sebagai contoh, model seharga $0,05/MTok yang gagal dalam 15% pemanggilan alat bisa memakan biaya lebih besar dalam percobaan ulang daripada model seharga $1/MTok yang gagal dalam 2%. Dalam pipeline kami, kami mencatat tingkat percobaan ulang per model dan membandingkan biaya per tugas yang diselesaikan, bukan biaya per token.

Jelajahi katalog model TokenLab dan mulai bandingkan biaya hari ini: Katalog model TokenLab.

Sumber

Harga diamati pada 2026-07-07

Model terkait

Model yang baru dirilis

Bangun dengan model dalam panduan ini

Bandingkan harga, uji rute, dan ubah riset menjadi panggilan API yang berjalan.