Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

TokenLab untuk Agen: Model yang Dapat Dibaca Mesin, Penetapan Harga, SDK, dan MCP

·19 September 2026·8 menit baca·Diperbarui 3 Oktober 2026·1510 tampilan
#fitur#agen#mcp#llms-txt#sdk
TokenLab untuk Agen: Model yang Dapat Dibaca Mesin, Penetapan Harga, SDK, dan MCP

Agen pengodean yang mengambil ID model dari memori pada akhirnya akan memilih ID yang sudah tidak ada, dan hal itu baru diketahui setelah muncul kode 404 atau tagihan yang mengejutkan. TokenLab MCP memberikan katalog langsung kepada agen untuk diperiksa terlebih dahulu, sehingga agen dapat memverifikasi ID, format permintaan yang diterima, dan harga sebelum menulis kode integrasi apa pun. Kami awalnya mendeskripsikan server ini sebagai server yang benar-benar hanya baca (read-only). Dokumentasi yang diamati pada 2026-10-03 menyatakan sebaliknya, jadi versi ini mengoreksi hal tersebut dan menambahkan alur kerja yang telah dikerjakan.

Poin Penting

  • Server TokenLab MCP memiliki tiga profil: catalog (tanpa API key), core, dan full. Hanya catalog yang bebas kunci.
  • Dengan kunci, server ini juga dapat mengirim permintaan model, membuat media, menangani file, dan memeriksa tugas asinkron. Server ini tidak hanya baca (read-only).
  • Lakukan perutean pada tokenlab.accepted_request_formats, tokenlab.pricing, tokenlab.lifecycle, dan tokenlab.deliveryAvailability. Jangan melakukan hard-code pada urutan rekomendasi.
  • Gemini Files, unggahan yang dapat dilanjutkan (resumable uploads), dan cachedContents tidak ada dalam profil MCP mana pun.
  • Jangan pernah menempelkan API key ke dalam prompt atau argumen alat (tool).

Apa yang diberikan server TokenLab MCP kepada agen pengodean

Sesuai dengan dokumentasi server MCP (diamati 2026-10-03), TokenLab MCP Server memungkinkan klien untuk menelusuri model dan harga saat ini, mengirim permintaan model, membuat media, bekerja dengan file, dan memeriksa tugas asinkron. Dokumentasi menyebutkan kemampuan-kemampuan berikut:

  • mencantumkan model dan membaca kemampuan satu model (list_models, get_model)
  • membaca harga saat ini atau membandingkan beberapa model
  • mengirim Chat Completions, Responses, Anthropic Messages, atau permintaan Gemini
  • mengevaluasi keputusan yang diketik dengan evaluate_decisions
  • membuat atau mengedit gambar; membuat video, musik, 3D, ucapan, transkripsi, atau terjemahan
  • mengunggah dan mengambil file melalui API /v1/files yang kompatibel dengan OpenAI
  • membuat embedding atau melakukan rerank dokumen
  • memeriksa dan membatalkan tugas asinkron yang didukung (get_task_status untuk polling)

Dokumentasi tidak mencantumkan nama alat untuk harga atau ikhtisar API dalam versi ini. Draf lama kami menamai get_model_pricing dan get_api_overview. Periksa daftar alat klien Anda yang terhubung sebelum Anda mengandalkan kedua nama tersebut.

Ketersediaan alat bergantung pada profil:

Profil API key Termasuk
catalog Tidak diperlukan Daftar model, detail model, harga, perbandingan, ikhtisar API
core Diperlukan untuk panggilan berbayar Alat chat umum, keputusan, media, audio, file, tugas, embedding, rerank, dan terjemahan
full Diperlukan untuk panggilan berbayar core ditambah API pengembang tambahan

Mulailah dengan catalog jika Anda hanya menginginkan pemilihan model yang lebih baik. Gunakan core ketika klien harus membuat konten atau memanggil model.

Instal server TokenLab MCP di klien Anda

Paket ini memerlukan Node.js 18.17 atau yang lebih baru dan npx. Paket ini berjalan secara lokal melalui stdio, jadi Anda tidak perlu instalasi global. Cadangkan konfigurasi aktif Anda terlebih dahulu, dan tambahkan hanya entri TokenLab. Perintah-perintah ini berasal dari dokumentasi, yang diamati pada 2026-10-03.

Claude Code:

claude mcp add \
  --env TOKENLAB_MCP_TOOL_PROFILE=catalog \
  --scope user \
  tokenlab -- \
  npx -y @tokenlabai/mcp-server@0.6.26

Codex:

codex mcp add \
  --env TOKENLAB_MCP_TOOL_PROFILE=catalog \
  tokenlab -- \
  npx -y @tokenlabai/mcp-server@0.6.26

Cursor (~/.cursor/mcp.json atau .cursor/mcp.json):

{
  "mcpServers": {
    "tokenlab": {
      "command": "npx",
      "args": ["-y", "@tokenlabai/mcp-server@0.6.26"],
      "env": {
        "TOKENLAB_MCP_TOOL_PROFILE": "catalog"
      }
    }
  }
}

VS Code menggunakan .vscode/mcp.json dengan kunci servers dan "type": "stdio". Claude Desktop menggunakan bentuk yang sama seperti Cursor di claude_desktop_config.json. Salin keduanya dari halaman dokumentasi.

Untuk mengaktifkan alat berbayar, buat kunci di Console → API keys dan atur kedua variabel di lingkungan server:

{
  "env": {
    "TOKENLAB_API_KEY": "<TOKENLAB_API_KEY>",
    "TOKENLAB_MCP_TOOL_PROFILE": "core"
  }
}

Kemudian mulai ulang klien dan jalankan claude mcp list atau codex mcp list. Minta agen untuk memanggil list_models. Daftar yang tidak kosong mengonfirmasi bahwa paket telah dimulai dan mencapai TokenLab. Jika kunci asli masuk ke dalam file bersama, log, atau riwayat shell, cabut kunci tersebut dan buat yang baru.

Satu alur agen: temukan, periksa, panggil

Berikut adalah alur yang kami gunakan. Bayangkan seorang agen diminta untuk menambahkan pembuatan gambar ke aplikasi Node.js. Setiap nilai di bawah ini berasal dari dokumentasi dan halaman model langsung yang diamati pada 2026-10-03.

1. Temukan. Minta daftar pendek saat ini, dengan alat MCP atau HTTP biasa:

{ "tool": "list_models", "arguments": { "recommended_for": "image" } }
curl "https://api.tokenlab.sh/v1/models?recommended_for=image"

Nilai recommended_for yang valid adalah image, video, music, 3d, tts, stt, embedding, rerank, dan translation. Katakanlah agen memilih nano-banana-pro.

2. Periksa format dan harga. Panggil get_model, atau GET /v1/models/nano-banana-pro (API model langsung, diamati 2026-10-03). Laporan tersebut menyatakan:

  • format permintaan yang diterima: gemini_generate_content, yang memetakan ke /v1beta/models/{model}:generateContent
  • kemampuan: image-edit, image-to-image, text-to-image
  • harga: per_request sebesar 0,067 USD, dengan kisaran harga 0,067 hingga 0,12 (harga diperbarui 2026-10-02T16:53:30.068Z)

Agen yang berasumsi menggunakan Chat Completions akan menulis kode yang salah. Bandingkan gpt-image-2 (API model langsung). Model ini tidak mencantumkan format permintaan yang diterima dan dihargai per token sebesar 3,5 USD untuk input dan 21 USD untuk output per 1 juta token. Bentuk harga berbeda untuk setiap model, jadi agen harus membacanya per model.

3. Lakukan panggilan. Untuk model chat, pemeriksaan format menentukan endpoint. gpt-5.6-terra menerima openai_chat_completions dan openai_responses (API model langsung, diamati 2026-10-03), jadi SDK standar berfungsi:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["TOKENLAB_API_KEY"],
    base_url="https://api.tokenlab.sh/v1",
)

response = client.chat.completions.create(
    model="gpt-5.6-terra",
    messages=[{"role": "user", "content": "Reply only with OK."}],
)
print(response.choices[0].message.content)

Kirim ID model yang dipilih secara eksplisit. Dokumentasi menyatakan bahwa TokenLab tidak menggantinya secara diam-diam. Klien harus meminta persetujuan sebelum panggilan berbayar jika harga atau pilihan model belum dikonfirmasi.

Untuk estimasi biaya, gpt-5.6-terra mengenakan biaya 0,6 USD per 1 juta token input hingga 272 ribu token input. Prompt 10.000 token kemudian memakan biaya sekitar 10.000 / 1.000.000 × 0,6 = 0,006 USD untuk input (estimasi, sebelum output). Di atas 272 ribu token input, seluruh permintaan berpindah ke tingkat yang lebih tinggi sebesar 1,2 USD untuk input dan 5,4 USD untuk output.

Bidang API model mana yang harus dipercaya agen untuk perutean

Baca ini dari GET /v1/models/{model} (Dapatkan Model, diamati 2026-10-03):

Bidang Apa artinya untuk perutean
tokenlab.accepted_request_formats Keluarga endpoint mana yang akan digunakan: openai_chat_completions adalah /v1/chat/completions, openai_responses adalah /v1/responses, anthropic_messages adalah /v1/messages
tokenlab.pricing / pricing_unit Harga publik saat ini dan unit penagihannya, seperti per_token atau per_image
tokenlab.max_input_tokens, max_output_tokens Batas konteks dan output. Untuk gpt-5.6-terra: 1.050.000 dan 128.000
tokenlab.supported_operations Operasi seperti text-to-image atau image-to-video
tokenlab.lifecycle Ketersediaan, tanggal rilis, tanggal penghentian, model pengganti
tokenlab.deliveryAvailability Dukungan verified dan official yang dikonfigurasi. Bidang yang hilang berarti tidak diketahui

Dua peringatan berlaku. Pertama, format yang diterima mengonfirmasi endpoint, tetapi alat dan bidang individu masih dapat bervariasi menurut model. Kedua, deliveryAvailability adalah dukungan yang dikonfigurasi, bukan jaminan waktu nyata. Perlakukan hasil recommended_for sebagai daftar pendek, karena dokumentasi mengatakan untuk tidak mematok urutannya.

Untuk harga saja, GET /v1/models/{model}/pricing adalah endpoint khusus harga. Entri kompleks dapat membawa tingkatan (tiers). seedance-2.0, misalnya, memiliki harga output yang bergantung pada resolusi dan input video dari 2,04 hingga 6,545 USD per 1 juta token (API model langsung, diamati 2026-10-03).

Bidang kesalahan yang memandu pemulihan

Pada kesalahan Chat Completions dan Responses yang kompatibel dengan OpenAI, panduan kesalahan (diamati 2026-10-03) mencantumkan did_you_mean, suggestions, hint, retryable, dan retry_after opsional. Tangani status HTTP dan code terlebih dahulu. 400 model_not_found mungkin membawa did_you_mean. Tunjukkan kepada pengguna alih-alih menukar model secara diam-diam. 503 all_channels_failed dapat memiliki retryable: false, dan mengulanginya tidak akan membantu. Anthropic Messages dan Gemini mempertahankan format kesalahan asli mereka.

Apa yang tidak dilakukan oleh server MCP

Dokumentasi menyatakan batasan-batasan ini:

  • Server ini tidak mengubah penyedia model utama klien Anda. Gunakan panduan penyiapan klien itu sendiri.
  • Server ini tidak mencakup Gemini Files, unggahan yang dapat dilanjutkan, atau cachedContents. Hal-hal tersebut memerlukan panggilan HTTP, sesuai dengan Gemini Files and cache.
  • Server ini bukan Skill. TokenLab Skill menginstal instruksi dengan npx skills add dan tidak memulai server MCP apa pun.
  • Server ini tidak melakukan polling untuk Anda saat waktu habis (timeout). Jika pemeriksaan status habis waktunya, jangan buat tugas kedua.
  • Server ini tidak membuat keputusan dapat dipercaya dengan sendirinya. Jawaban Noul dari evaluate_decisions adalah probabilitas, bukan Boolean. Validasi terhadap kasus berlabel Anda sendiri.

Profil catalog tidak dapat melakukan panggilan berbayar sama sekali. Alat gambar mengembalikan hasil atau tugas, tergantung pada modelnya. Video, musik, dan 3D selalu mengembalikan tugas.

Di mana Anda masih memerlukan permukaan HTTP biasa

Dalam pipeline kami, kami menyimpan endpoint penemuan HTTP bersama MCP untuk agen non-MCP. https://api.tokenlab.sh/llms.txt adalah ikhtisar ringkas dengan permintaan pertama, endpoint umum, dan panduan kesalahan. Dokumentasi yang diamati pada 2026-10-03 tidak mencakup file llms-full.txt atau file snapshot model-data dari draf kami sebelumnya. Verifikasi URL tersebut sendiri sebelum Anda bergantung padanya. Untuk status dan biaya langsung, lihat katalog Model publik.

FAQ

Apakah saya memerlukan API key untuk menggunakan server TokenLab MCP?

Tidak, tidak untuk penelusuran. Profil catalog mencantumkan model, detail, harga, dan perbandingan tanpa kunci. Permintaan model atau media berbayar memerlukan TOKENLAB_API_KEY di lingkungan server, dengan profil core atau full.

Profil MCP mana yang harus saya mulai?

Mulailah dengan catalog jika Anda hanya menginginkan pemilihan model yang lebih baik. Pindah ke core ketika klien harus memanggil model atau membuat media. Gunakan full hanya jika agen benar-benar memerlukan API pengembang tambahan.

Bidang model mana yang harus dipercaya agen saat memilih model?

Percayai accepted_request_formats untuk endpoint, pricing dengan unitnya untuk biaya, batas token, supported_operations, dan lifecycle. Perlakukan deliveryAvailability sebagai dukungan yang dikonfigurasi, bukan ketersediaan langsung.

Mengapa agen saya mendapatkan kesalahan 503 all_channels_failed?

Operasi tersebut mungkin tidak memiliki pasokan di tingkat Pengiriman (Delivery tier) yang dipilih. Jika retryable adalah false, jangan ulangi permintaan tersebut. Periksa ketersediaan dengan GET /v1/models dan pilih model lain dengan persetujuan pengguna.

Apakah server MCP mendukung Gemini Files atau cachedContents?

Tidak. Dokumentasi mengatakan Gemini Files, unggahan yang dapat dilanjutkan, dan cachedContents saat ini memerlukan panggilan HTTP. Alat file MCP menggunakan API /v1/files yang kompatibel dengan OpenAI.

Buat kunci di Console → API keys, lalu tambahkan profil catalog ke klien Anda dengan perintah di atas.

Sumber

Harga diamati pada 2026-10-03

Model terkait

Model yang baru dirilis

Bangun dengan model dalam panduan ini

Bandingkan harga, uji rute, dan ubah riset menjadi panggilan API yang berjalan.