TokenLab

Hướng dẫn cốt lõi

Tích hợp TokenLab đáng tin cậy

Tích hợp TokenLab đáng tin cậy

Mô hình và chi phí

Xem khả năng và giá hiện tại qua API hoặc trang mô hình. So sánh cùng một tác vụ và chỉ định mô hình trong mỗi yêu cầu. Không tự ý đổi mô hình vì giá, chất lượng, công cụ và ngữ cảnh có thể thay đổi.

Giới hạn đầu ra theo định dạng và mô hình, giảm ngữ cảnh trùng lặp. Chi phí media có thể phụ thuộc số lượng, thời lượng hoặc độ phân giải; hiển thị ước tính có sẵn trước khi xác nhận lần tạo tốn kém.

Streaming và thử lại

Streaming hiển thị văn bản sớm hơn nhưng không giảm chi phí token. Giữ phần đầu ra hữu ích khi mất kết nối mà không đánh dấu là câu trả lời hoàn chỉnh.

Với 429, đợi theo Retry-After hoặc retry_after; dùng thời gian lùi ngắn cho 5xx tạm thời. Lỗi xác thực, quyền, số dư, dữ liệu và ngữ cảnh cần được sửa. Giới hạn số lần thử và tổng thời gian, tránh lặp thêm cơ chế retry của SDK.

Khóa và bản ghi

Giữ khóa trên máy chủ hoặc trình quản lý bí mật, không đặt trong trình duyệt, gói ứng dụng, kho công khai hay log. Tách khóa phát triển, sản xuất và từng ứng dụng, giới hạn mô hình và chi tiêu, thu hồi ngay khóa bị lộ.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["TOKENLAB_API_KEY"],
    base_url="https://api.tokenlab.sh/v1",
    timeout=30.0,
    max_retries=0,
)

Ghi request_id, task_id, billing_transaction_id được trả về, mô hình, endpoint và mã công việc riêng. Không ghi thông tin xác thực, toàn bộ prompt riêng tư, media hoặc URL có chữ ký. Xem số tiền cuối cùng trong Usage hoặc API quản lý.

Tác vụ bất đồng bộ

Lưu ID và poll_url ngay khi tạo tác vụ bất đồng bộ, rồi kiểm tra đến completed hoặc failed. Lỗi truy vấn không có nghĩa tác vụ tạo thất bại. Sau timeout hoặc tải lại, tiếp tục tác vụ đã lưu; dùng khóa idempotency khi endpoint hỗ trợ.

Công Việc Không Đồng Bộ & Kiểm Tra

Trước khi phát hành

Trước khi phát hành, kiểm tra đúng mô hình và định dạng, kết quả thành công và lỗi thường gặp, giá hiện tại, tải lại trang và nhấp nhiều lần.

Trên trang này