الأدلة الأساسية

حدود معدل الطلبات

حدود معدل الطلبات

القيم الافتراضية في الدقيقة هي User ‏1,000 وPartner ‏10,000 وVIP ‏10,000، وقد تختلف الإعدادات الفعلية. تطبق هذه الحدود لكل مفتاح API على الطلبات التي تتطلب مصادقة. لنقاط الاكتشاف العامة مثل GET /v1/models حدود مستقلة. عند 429 اعتمد على X-RateLimit-Limit وRetry-After بدل جدول منسوخ.

429 / Retry-After

{
  "error": {
    "message": "Rate limit exceeded. Please retry later.",
    "type": "rate_limit_exceeded",
    "code": "rate_limit_exceeded",
    "retryable": true,
    "retry_after": 8
  }
}
Retry-After: 8

انتظر عدد الثواني المحدد في Retry-After، وإن غاب فاستخدم تراجعًا أُسيًا مع تغير عشوائي. المثال يحدد أربع محاولات كحد أقصى ويعطل إعادة المحاولة في SDK ويحافظ على النموذج المختار.

import random
import time
from openai import RateLimitError

def chat_with_rate_limit_retry(client, model, messages, attempts=4):
    for attempt in range(attempts):
        try:
            return client.with_options(max_retries=0).chat.completions.create(
                model=model,
                messages=messages,
            )
        except RateLimitError as exc:
            if attempt == attempts - 1:
                raise
            header = exc.response.headers.get("Retry-After")
            wait = float(header) if header else min(30, 2 ** attempt + random.random())
            time.sleep(wait)

حدد التزامن وضع دفعات الطلبات المفاجئة في طابور وخزّن مؤقتًا النتائج الآمنة لإعادة الاستخدام فقط. لا تكرر أخطاء التحقق أو المصادقة أو الصلاحيات أو الرصيد. النموذج الأسرع لا يزيد حد الطلبات. لطلب تعديل أرسل الحساب والحجم المتوقع والاستخدام إلى support@tokenlab.sh.

في هذه الصفحة