Hướng dẫn cốt lõi
Giới hạn yêu cầu
Giới hạn yêu cầu
Mặc định mỗi phút là User 1.000, Partner 10.000 và VIP 10.000; cấu hình thực tế có thể khác. Với các yêu cầu cần xác thực, các giới hạn này áp dụng theo khóa API. Endpoint khám phá công khai như GET /v1/models có giới hạn riêng. Khi gặp 429, dùng X-RateLimit-Limit và Retry-After thay vì bảng sao chép.
429 / Retry-After
{
"error": {
"message": "Rate limit exceeded. Please retry later.",
"type": "rate_limit_exceeded",
"code": "rate_limit_exceeded",
"retryable": true,
"retry_after": 8
}
}Retry-After: 8Đợi số giây trong Retry-After; nếu không có, dùng thời gian lùi theo cấp số nhân với độ lệch ngẫu nhiên. Ví dụ giới hạn bốn lần thử, tắt retry của SDK và giữ mô hình đã chọn.
import random
import time
from openai import RateLimitError
def chat_with_rate_limit_retry(client, model, messages, attempts=4):
for attempt in range(attempts):
try:
return client.with_options(max_retries=0).chat.completions.create(
model=model,
messages=messages,
)
except RateLimitError as exc:
if attempt == attempts - 1:
raise
header = exc.response.headers.get("Retry-After")
wait = float(header) if header else min(30, 2 ** attempt + random.random())
time.sleep(wait)Giới hạn đồng thời, xếp hàng khi lưu lượng tăng đột biến và chỉ cache kết quả an toàn để tái sử dụng. Không thử lại lỗi dữ liệu, xác thực, quyền hoặc số dư. Mô hình nhanh hơn không làm tăng hạn mức. Gửi tài khoản, lưu lượng dự kiến và mục đích tới support@tokenlab.sh để đề nghị điều chỉnh.