Panduan inti
Integrasi TokenLab yang andal
Integrasi TokenLab yang andal
Model dan biaya
Periksa kemampuan dan harga terbaru melalui API atau halaman model. Bandingkan tugas yang sama dan tentukan model pada setiap permintaan. Jangan mengganti model diam-diam karena harga, kualitas, tool, dan konteks dapat berubah.
Batasi keluaran sesuai format dan model serta kurangi konteks berulang. Biaya media dapat bergantung pada jumlah, durasi, atau resolusi; tampilkan estimasi yang tersedia sebelum mengonfirmasi generasi mahal.
Streaming dan retry
Streaming menampilkan teks lebih cepat, tetapi tidak mengurangi biaya token. Simpan keluaran parsial yang berguna saat koneksi terputus tanpa menandainya sebagai jawaban lengkap.
Untuk 429, tunggu sesuai Retry-After atau retry_after; gunakan backoff singkat untuk 5xx sementara. Error autentikasi, izin, saldo, validasi, dan konteks perlu diperbaiki. Batasi jumlah percobaan dan waktu total tanpa menggandakan retry bawaan SDK.
Kunci dan catatan
Simpan kunci di server atau pengelola rahasia, bukan browser, paket aplikasi, repositori publik, atau log. Pisahkan pengembangan, produksi, dan aplikasi, batasi model serta belanja, dan cabut kunci yang bocor.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TOKENLAB_API_KEY"],
base_url="https://api.tokenlab.sh/v1",
timeout=30.0,
max_retries=0,
)Catat request_id, task_id, billing_transaction_id yang dikembalikan, model, endpoint, dan ID pekerjaan Anda. Jangan catat kredensial, prompt privat lengkap, media, atau URL bertanda tangan. Nilai akhir tersedia di Usage atau API manajemen.
Tugas asinkron
Simpan ID dan poll_url setelah tugas asinkron dibuat, lalu periksa hingga completed atau failed. Kegagalan pengecekan tidak berarti generasi gagal. Setelah timeout atau refresh, lanjutkan tugas tersimpan; gunakan kunci idempotensi jika endpoint mendukungnya.
Sebelum rilis
Sebelum rilis, uji model dan format yang digunakan, hasil sukses dan error umum, harga terbaru, refresh, serta klik berulang.