Teks
Buat Penyelesaian Obrolan
Membuat penyelesaian untuk pesan obrolan
Isi Permintaan
Parameter opsional yang didukung, nilai yang diizinkan, dan nilai default bergantung pada model yang dipilih. Periksa detail model sebelum menetapkan opsi sampling, penalaran, atau alat.
ID model yang akan digunakan. Lihat Models untuk opsi yang tersedia.
Daftar pesan yang membentuk percakapan.
Setiap objek pesan berisi:
role(string):system,developer,user,assistant,tool,functioncontent(string | array | null): Konten pesan
Untuk pesan assistant yang berisi tool_calls, content dapat dihilangkan atau diatur ke null.
Ketika content adalah array, TokenLab mendukung blok multimodal terstruktur untuk model yang kompatibel:
- text:
{ "type": "text", "text": "..." } - gambar:
{ "type": "image_url", "image_url": { "url": "https://..." } } - video:
{ "type": "video_url", "video_url": { "url": "https://..." } } - audio:
{ "type": "audio_url", "audio_url": { "url": "https://..." } }
Untuk input multimodal, gunakan URL https yang dapat diakses publik. Jenis media yang didukung bergantung pada model yang dipilih.
Temperatur sampling. Dukungan, nilai yang diizinkan, dan nilai default bergantung pada model yang dipilih. Hilangkan kolom ini untuk menggunakan default model.
Jumlah maksimum token yang akan dihasilkan.
falseJika true, delta pesan parsial akan dikirim sebagai event SSE.
Opsi untuk streaming. Setel include_usage: true untuk menerima pemakaian token dalam potongan stream.
Parameter nucleus sampling. Kami menyarankan mengubah ini atau temperature, bukan keduanya.
Angka antara -2.0 dan 2.0. Nilai positif memberi penalti pada token yang berulang.
Angka antara -2.0 dan 2.0. Nilai positif memberi penalti pada token yang sudah ada di teks.
Urutan berhenti atau daftar urutan. Dukungan dan batas jumlah urutan bergantung pada model yang dipilih.
Daftar tools yang mungkin dipanggil model (pemanggilan fungsi).
Mengontrol bagaimana model menggunakan tools. Opsi: auto, none, required, atau objek tool tertentu.
Mengizinkan beberapa panggilan alat dalam satu giliran asisten, jika model yang dipilih mendukungnya.
Token maksimum untuk penyelesaian. Alternatif untuk max_tokens, berguna untuk keluarga model terbaru yang mendukung reasoning.
Tingkat penalaran untuk model yang mendukungnya. Nilai yang diizinkan bergantung pada model yang dipilih.
Seed sampling untuk model yang mendukungnya. Output yang identik tidak dijamin.
Jumlah penyelesaian yang akan dihasilkan (1-128).
Apakah akan mengembalikan log probabilitas.
Jumlah top log probabilitas yang dikembalikan (0-20). Memerlukan logprobs: true.
Sampling Top-K untuk model yang mendukungnya.
Format respons. Gunakan {"type": "json_object"} untuk mode JSON atau {"type": "json_schema", "json_schema": {...}} untuk skema JSON. Dukungan bergantung pada model yang dipilih.
Mengubah kemungkinan token tertentu muncul. Pemetaan ID token (sebagai string) ke nilai bias dari -100 sampai 100.
Identifier unik yang merepresentasikan pengguna akhir Anda untuk pemantauan penyalahgunaan.
Respons
Pengidentifikasi unik untuk penyelesaian.
Selalu chat.completion.
Timestamp Unix saat penyelesaian dibuat.
Model yang digunakan untuk penyelesaian.
Daftar pilihan penyelesaian.
Setiap pilihan berisi:
index(integer): Indeks pilihanmessage(object): Pesan yang dihasilkanfinish_reason(string): Alasan model berhenti, misalnyastop,length, atautool_calls
Statistik penggunaan token.
prompt_tokens(integer): Token dalam promptcompletion_tokens(integer): Token dalam penyelesaiantotal_tokens(integer): Total token yang digunakan
Permintaan
curl -X POST "https://api.tokenlab.sh/v1/chat/completions" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Hello!"}
],
"max_tokens": 1000
}'Contoh Multimodal
{
"model": "gemini-2.5-pro",
"messages": [
{
"role": "user",
"content": [
{ "type": "text", "text": "Describe this video briefly." },
{ "type": "video_url", "video_url": { "url": "https://example.com/demo.mp4" } }
]
}
],
"max_tokens": 64
}Respons
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"created": 1706000000,
"model": "gpt-5.6-terra",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! How can I help you today?"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 20,
"completion_tokens": 9,
"total_tokens": 29
}
}Otorisasi
BearerAuth Autentikasi API Key. Buat atau kelola API key di Dashboard > API > API Keys.
Lokasi: header
Header
Kebijakan Pengiriman per-permintaan. Menggantikan default API key dan Workspace. Secara otomatis mencoba TokenLab Verified terlebih dahulu dan dapat beralih satu kali ke Official saja sebelum output, penerimaan permintaan, atau pembuatan sumber daya persisten.
Nilai yang tersedia
- "auto"
- "verified"
- "official"
Body permintaan
application/json
Respons
application/json
application/json
application/json
application/json
application/json
application/json
application/json