TokenLab

Văn bản

Tạo Hoàn Thiện Cuộc Trò Chuyện

Tạo một kết quả hoàn chỉnh cho tin nhắn chat

POST
/v1/chat/completions

Thân yêu cầu

Các tham số tùy chọn được hỗ trợ, giá trị hợp lệ và giá trị mặc định phụ thuộc vào mô hình đã chọn. Xem chi tiết mô hình trước khi đặt tùy chọn lấy mẫu, suy luận hoặc công cụ.

modelstringbắt buộc

ID của mô hình để sử dụng. Xem Models để biết các tùy chọn có sẵn.

messagesarraybắt buộc

Danh sách các tin nhắn tạo thành cuộc trò chuyện.

Mỗi đối tượng tin nhắn chứa:

  • role (string): system, developer, user, assistant, tool, function
  • content (string | array | null): Nội dung tin nhắn

Với tin nhắn assistant chứa tool_calls, có thể bỏ qua content hoặc đặt thành null.

Khi content là một mảng, TokenLab hỗ trợ các khối đa phương tiện có cấu trúc cho các mô hình tương thích:

  • text: { "type": "text", "text": "..." }
  • hình ảnh: { "type": "image_url", "image_url": { "url": "https://..." } }
  • video: { "type": "video_url", "video_url": { "url": "https://..." } }
  • âm thanh: { "type": "audio_url", "audio_url": { "url": "https://..." } }

Với đầu vào đa phương tiện, hãy dùng URL https có thể truy cập công khai. Các loại phương tiện được hỗ trợ phụ thuộc vào mô hình đã chọn.

temperaturenumber

Nhiệt độ lấy mẫu. Khả năng hỗ trợ, giá trị hợp lệ và giá trị mặc định phụ thuộc vào mô hình đã chọn. Bỏ qua trường này để dùng mặc định của mô hình.

max_tokensinteger

Số token tối đa được sinh.

streambooleanmặc định: false

Nếu true, các delta tin nhắn từng phần sẽ được gửi dưới dạng sự kiện SSE.

stream_optionsobject

Các tùy chọn cho streaming. Đặt include_usage: true để nhận thông tin sử dụng token trong các đoạn stream.

top_pnumber

Tham số Nucleus sampling. Chúng tôi khuyến nghị điều chỉnh tham số này hoặc temperature, không cả hai.

frequency_penaltynumber

Số trong khoảng -2.0 đến 2.0. Giá trị dương phạt các token lặp lại.

presence_penaltynumber

Số trong khoảng -2.0 đến 2.0. Giá trị dương phạt các token đã xuất hiện trong văn bản.

stopstring | array

Chuỗi dừng hoặc danh sách chuỗi. Khả năng hỗ trợ và giới hạn số chuỗi phụ thuộc vào mô hình đã chọn.

toolsarray

Danh sách các công cụ mà mô hình có thể gọi (gọi hàm).

tool_choicestring | object

Điều khiển cách mô hình sử dụng công cụ. Tùy chọn: auto, none, required, hoặc một đối tượng công cụ cụ thể.

parallel_tool_callsboolean

Cho phép nhiều lệnh gọi công cụ trong một lượt của trợ lý, nếu mô hình đã chọn hỗ trợ.

max_completion_tokensinteger

Số token tối đa cho phần completion. Thay thế cho max_tokens, hữu ích cho các họ mô hình mới hỗ trợ reasoning.

reasoning_effortstring

Mức độ suy luận cho mô hình có hỗ trợ. Giá trị hợp lệ phụ thuộc vào mô hình đã chọn.

seedinteger

Seed lấy mẫu cho mô hình có hỗ trợ. Không bảo đảm đầu ra giống hệt nhau.

ninteger

Số completions cần sinh (1-128).

logprobsboolean

Có trả về log probabilities hay không.

top_logprobsinteger

Số log probabilities hàng đầu cần trả về (0-20). Yêu cầu logprobs: true.

top_kinteger

Lấy mẫu Top-K cho mô hình có hỗ trợ.

response_formatobject

Định dạng phản hồi. Dùng {"type": "json_object"} cho chế độ JSON hoặc {"type": "json_schema", "json_schema": {...}} cho JSON Schema. Khả năng hỗ trợ phụ thuộc vào mô hình đã chọn.

logit_biasobject

Thay đổi khả năng xuất hiện của các token được chỉ định. Map token IDs (dưới dạng chuỗi) tới giá trị bias từ -100 đến 100.

userstring

Một định danh duy nhất đại diện cho người dùng cuối của bạn để giám sát lạm dụng.

Phản hồi

idstring

Định danh duy nhất cho kết quả hoàn thiện.

objectstring

Luôn là chat.completion.

createdinteger

Unix timestamp khi kết quả hoàn thiện được tạo.

modelstring

Mô hình được sử dụng cho completion.

choicesarray

Danh sách các lựa chọn completion.

Mỗi lựa chọn chứa:

  • index (integer): Chỉ số của lựa chọn
  • message (object): Tin nhắn được sinh ra
  • finish_reason (string): Lý do mô hình dừng, chẳng hạn stop, length hoặc tool_calls
usageobject

Thống kê sử dụng token.

  • prompt_tokens (integer): Số token trong prompt
  • completion_tokens (integer): Số token trong completion
  • total_tokens (integer): Tổng số token đã sử dụng

Yêu cầu

curl -X POST "https://api.tokenlab.sh/v1/chat/completions" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-terra",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Hello!"}
    ],
    "max_tokens": 1000
  }'

Ví dụ đa phương tiện

{
  "model": "gemini-2.5-pro",
  "messages": [
    {
      "role": "user",
      "content": [
        { "type": "text", "text": "Describe this video briefly." },
        { "type": "video_url", "video_url": { "url": "https://example.com/demo.mp4" } }
      ]
    }
  ],
  "max_tokens": 64
}

Phản hồi

Response
{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "created": 1706000000,
  "model": "gpt-5.6-terra",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Hello! How can I help you today?"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 20,
    "completion_tokens": 9,
    "total_tokens": 29
  }
}

Xác thực

BearerAuth
AuthorizationBearer <token>

Xác thực bằng Khóa API. Tạo hoặc quản lý khóa API trong Dashboard > API > API Keys.

Vị trí: header

Header

X-TokenLab-Delivery-Policy?string

Chính sách phân phối theo yêu cầu. Ghi đè các mặc định của API key và Workspace. Tự động thử TokenLab Verified trước và có thể chuyển đổi một lần sang Official chỉ trước khi xuất, chấp nhận yêu cầu hoặc tạo tài nguyên cố định.

Giá trị hợp lệ

  • "auto"
  • "verified"
  • "official"

Nội dung yêu cầu

application/json

Phản hồi

application/json

application/json

application/json

application/json

application/json

application/json

application/json