اختر Auto أو TokenLab Verified أو Official لكل طلب، مع عرض الأسعار مسبقاً.اطلع على الجديد

بديل Together AI: عندما تحتاج إلى بساطة الـ Gateway، وليس البنية التحتية

·١٩ سبتمبر ٢٠٢٦·3 دقائق قراءة·آخر تحديث ٣ أكتوبر ٢٠٢٦·1745 مشاهدة
#منافس#AI API#TokenLab
بديل Together AI: عندما تحتاج إلى بساطة الـ Gateway، وليس البنية التحتية

معظم الفرق التي تبحث عن بديل لـ Together AI لا تحتاج إلى مجموعة خوادم GPU مختلفة؛ بل تحتاج إلى عدد أقل من الأجزاء المتحركة. تصف وثائق Together نفسها استنتاج (inference) بدون خادم (serverless) لكل token، بالإضافة إلى منتجات منفصلة للضبط الدقيق (fine-tuning)، والإنتاجية المخصصة (provisioned-throughput). توثق TokenLab رصيداً واحداً، ومفتاح API واحداً، وأربعة تنسيقات للطلبات. لقد قرأنا مجموعتي الوثائق في 2026-10-03 وأعدنا صياغة هذه المقالة بناءً على ما تنص عليه فعلياً. كانت العديد من الأرقام في النسخة السابقة خاطئة، لذا قمنا باستبدالها.

أبرز النقاط

  • تقبل كلتا واجهتي البرمجة (APIs) تنسيق Chat Completions الخاص بـ OpenAI. تستخدم Together الرابط https://api.together.ai/v1؛ بينما تستخدم TokenLab الرابط https://api.tokenlab.sh/v1 (تمت ملاحظة الوثائق في 2026-10-03).
  • توثق TokenLab حدوداً لكل مفتاح تبلغ 1,000 طلب في الدقيقة لفئة المستخدم (User tier). الصفحة الخاصة بـ Together التي قرأناها لا تعطي حداً رقمياً وتصف أداء الـ serverless بأنه "بذل قصارى الجهد" (best-effort).
  • بالنسبة للنماذج الثلاثة التي تمكنا من مطابقتها بالاسم، الأسعار متساوية لـ glm-5.2 وأقل في Together لـ qwen3.7-plus. أما deepseek-v4-pro فيعتمد السعر على الوقت من اليوم وعلى إصدار Together الذي تقارنه به.
  • توثق TokenLab خيارات التسليم (auto، verified، official) وقواعد إعادة المحاولة. وهي لا توثق خاصية تجاوز الفشل (failover) بين النماذج، لذا نحن لا نعد بها.
  • ابقَ مع Together إذا كنت بحاجة إلى API الخاص بالضبط الدقيق (fine-tuning)، أو Batch API، أو نقاط النهاية المخصصة (dedicated endpoints)، أو الإنتاجية المخصصة (provisioned throughput) مع اتفاقية مستوى خدمة (SLA).

بديل Together AI: ما تقوله الوثائق جنباً إلى جنب

لقد قارنا فقط ما ينشره كلا الموردين. حيثما تكون الخلية فارغة من الأرقام، فإن الوثائق التي قرأناها لم تقدم أياً منها.

العنصر Together AI TokenLab المصدر وتاريخ الملاحظة
رابط القاعدة (Base URL) https://api.together.ai/v1 https://api.tokenlab.sh/v1 (تستخدم Anthropic SDK و Gemini الرابط https://api.tokenlab.sh) توافق Together مع OpenAI، أدلة ترحيل TokenLab؛ 2026-10-03
توافق API استدعاءات OpenAI SDK للدردشة، الإكمال، التضمينات، الصور، الكلام، النسخ؛ لا يتم دعم المساعدين (Assistants) ودفعات OpenAI (batches) Chat Completions، الردود، رسائل Anthropic، generateContent لـ Gemini؛ كل نموذج يسرد accepted_request_formats الخاصة به نفس الصفحتين بالإضافة إلى تنسيقات API؛ 2026-10-03
حدود المعدل (Rate limits) لا يوجد حد رقمي في الصفحة؛ 429 أو 503 تحت الطلب المرتفع؛ إنتاجية مخصصة للضمانات لكل مفتاح API: المستخدم 1,000، الشريك 10,000، VIP 10,000 طلب في الدقيقة حدود معدل Together، حدود معدل TokenLab؛ 2026-10-03
glm-5.2 لكل 1 مليون token الإدخال 1.40 دولار، الإخراج 4.40 دولار (zai-org/GLM-5.2) الإدخال 1.4 دولار، الإخراج 4.4 دولار نماذج Together، API نموذج TokenLab؛ 2026-10-03
qwen3.7-plus لكل 1 مليون token الإدخال 0.32 دولار، الإخراج 1.28 دولار (Qwen/Qwen3.7-Plus) الإدخال 0.4 دولار، الإخراج 1.6 دولار حتى 256,000 token إدخال؛ 1.2 دولار و 4.8 دولار حتى 1,000,000 نماذج Together، API نموذج TokenLab؛ 2026-10-03
deepseek-v4-pro لكل 1 مليون token الإدخال 1.32 دولار، الإخراج 3.96 دولار (deepseek-ai/DeepSeek-V4-Pro-0813) خارج أوقات الذروة 0.66 دولار و 1.98 دولار؛ في أوقات الذروة 1.32 دولار و 3.96 دولار نماذج Together، API نموذج TokenLab؛ 2026-10-03

ثلاثة تحذيرات تنطبق على صفوف الأسعار:

  • نافذة الذروة في TokenLab هي 09:00-12:00 و 14:00-18:00 بتوقيت بكين. تسرد صفحة Together سعراً واحداً لـ DeepSeek وإصدار "0813" محدداً، لذا قد لا يصف الصفان نفس النموذج تماماً.
  • أسعار قراءة الذاكرة المؤقتة (Cache-read) متساوية أيضاً في glm-5.2: 0.26 دولار لكل 1 مليون token على كلا الجانبين.
  • تظهر glm-5.2 و deepseek-v4-pro و qwen3.7-plus كـ verified: false, official: true على TokenLab. وهذا مهم لقسم التسليم أدناه.

إليك تقدير عملي لـ 10 مليون token إدخال و 2 مليون token إخراج لـ qwen3.7-plus، مع كل مطالبة (prompt) أقل من 256,000 token:

  • TokenLab: 10 × 0.4 دولار + 2 × 1.6 دولار = 7.20 دولار.
  • Together: 10 × 0.32 دولار + 2 × 1.28 دولار = 5.76 دولار.

كلا الرقمين تقديرات من الأسعار المعلنة. وهي تستثني التخزين المؤقت والضرائب. تقول وثائق TokenLab إن أقل سعر لكل token ليس دائماً أقل تكلفة لكل مهمة مكتملة، لذا قارن التكلفة النهائية في الاستخدام (Usage) على مطالباتك الخاصة.

النسخة السابقة من هذه المقالة سردت أيضاً أسعار TokenLab لـ gpt-5.5 و claude-sonnet-5 و deepseek-v4-pro والتي لا تتطابق مع API النموذج المباشر. في 2026-10-03 أظهر الـ API هذه الأسعار:

النموذج الإدخال لكل 1 مليون الإخراج لكل 1 مليون الحد الأقصى لـ tokens الإدخال المصدر
gpt-5.5 1.5 دولار 9 دولار 1,000,000 model API
claude-sonnet-5 0.9 دولار 4.5 دولار 1,000,000 model API

تقول الوثائق بعدم نسخ جدول الأسعار برمجياً (hard-code)، ونحن نتفق مع ذلك. لقد حذفنا الصفوف الخاصة بالنماذج التي لم نتمكن من تأكيد أسعارها.

خيارات التسليم وإعادة المحاولة في TokenLab

توثق TokenLab ثلاثة خيارات للتسليم، يتم اختيارها لكل طلب باستخدام ترويسة X-TokenLab-Delivery-Policy (إما auto أو verified أو official). تتجاوز ترويسة الطلب إعداد مفتاح الـ API، والذي يتجاوز بدوره الإعداد الافتراضي لمساحة العمل (مرجع API، تمت ملاحظته في 2026-10-03).

  • TokenLab Verified هو تسليم تم التحقق منه بواسطة TokenLab، بأسعار TokenLab.
  • Official يعتمد على السعر العام لصانع النموذج.
  • Auto يستخدم Verified عند توفره، ثم Official إذا لزم الأمر. أنت تدفع مقابل الخيار الذي يكمل الطلب.

يتم محاسبة كل طلب مكتمل مرة واحدة، مقابل الخيار الذي أنتج النتيجة (الفواتير). الترويسة غير الصالحة تعيد 400. إذا كان الخيار المطلوب غير متاح، ستحصل على 503 delivery_tier_unavailable مع معرف طلب. عندما لا يكون للعملية أي إمداد، تكون retryable هي false، ولا يجب عليك تكرار الطلب دون تغيير.

تصف الوثائق عمليات إعادة المحاولة حسب رمز الحالة (معالجة الأخطاء، حدود المعدل):

الحالة الإجراء الموثق
400, 401, 402, 403, 404, 413 لا تكرر؛ قم بتغيير الطلب، أو المفتاح، أو الرصيد، أو الأذونات، أو الإدخال
429 أعد المحاولة بعد تأخير Retry-After؛ استخدم التراجع الأسي (exponential backoff) مع التذبذب (jitter) إذا كان مفقوداً
500-504 أعد المحاولة فقط عندما تكون retryable هي true؛ احترم retry_after وحدد عدد المحاولات

ساعدتنا تفصيلتان إضافيتان. تقوم عملاء البدء السريع (quickstart clients) بضبط max_retries=0، لذا تظل سياسة إعادة المحاولة في كودك. لا ينبغي إعادة محاولة طلبات الإنشاء غير المتزامنة (الفيديو، الموسيقى، ثلاثي الأبعاد) قبل التحقق مما إذا كانت المهمة موجودة بالفعل. لم نجد أي رقم موثق لزمن انتقال البوابة (gateway latency) أو خاصية تجاوز الفشل التلقائي بين النماذج، لذا قمنا بإزالة ادعاء 15-40ms القديم ووعد تجاوز الفشل.

مقتطف الترحيل: إكمال واحد على كل API

استخدمنا glm-5.2 لأن كلا الموردين يسردانه. يتبع سلسلة نموذج Together التنسيق <provider>/<model_name>؛ بينما لا تحمل معرفات TokenLab أي بادئة مزود.

import os
from openai import OpenAI

together = OpenAI(
    api_key=os.environ["TOGETHER_API_KEY"],
    base_url="https://api.together.ai/v1",
)
tokenlab = OpenAI(
    api_key=os.environ["TOKENLAB_API_KEY"],
    base_url="https://api.tokenlab.sh/v1",
    timeout=30.0,
    max_retries=0,
)

messages = [{"role": "user", "content": "Reply only with OK."}]

a = together.chat.completions.create(model="zai-org/GLM-5.2", messages=messages)
b = tokenlab.chat.completions.create(model="glm-5.2", messages=messages)

print(a.choices[0].message.content)
print(b.choices[0].message.content)

المصادر: توافق Together مع OpenAI و بداية TokenLab السريعة، كلاهما تمت ملاحظته في 2026-10-03. تأكد من معرف النموذج باستخدام GET /v1/models قبل إرسال حركة المرور. إذا كنت قادماً من OpenRouter، يقول دليل الترحيل بتبديل رابط القاعدة (base URL) وإسقاط بادئة المزود من معرفات النماذج.

من يجب أن يبقى، ومن يجب أن يختار بديلاً لـ Together AI

ابقَ مع Together AI إذا كنت بحاجة إلى ما تسرده وثائقها ولا تسرده وثائق TokenLab:

  • API الخاص بالضبط الدقيق (fine-tuning) و Batch API الأصليين لـ Together.
  • كتالوج استنتاج نماذج مخصص.
  • الإنتاجية المخصصة (provisioned throughput)، التي تحجز السعة بموجب اتفاقية مستوى خدمة (SLA) محددة.

تحدد صفحة توافق OpenAI الخاصة بـ Together أن fine_tuning.jobs.* و batches.* غير مدعومين في تنسيق OpenAI، لذا تستخدم أعباء العمل هذه واجهات برمجة التطبيقات الخاصة بـ Together. لم نجد شيئاً في الأدلة حول استضافة أوزان مخصصة على TokenLab. تحقق من صفحة النماذج على tokenlab.sh/models أو اسأل support@tokenlab.sh قبل التخطيط بناءً على ذلك.

تتناسب TokenLab بشكل أفضل عندما تتطابق احتياجاتك مع هذه الاختلافات الموثقة:

  • تريد رصيداً واحداً عبر النماذج، بدون اشتراك أو حد أدنى للإنفاق.
  • تحتاج إلى حقول رسائل Anthropic (التفكير، استخدام أدوات Claude) أو contents الأصلية لـ Gemini على نفس المفتاح.
  • تريد اختيار تسليم Verified أو Official أو Auto لكل طلب.
  • تريد OpenAI Responses API على النماذج التي تسرد openai_responses.

تخيل فريقاً يتصل بالفعل بـ gpt-5.5 و claude-sonnet-5. كلا النموذجين يسردان openai_chat_completions كتنسيق مقبول، لذا يغطي عميل OpenAI واحد كلاهما. نموذج مفتوح الأوزان لمورد ثالث، مثل glm-5.2، يعمل على نفس العميل ونفس الرصيد. يعمل النظام الهجين أيضاً: تظل حركة المرور المضبوطة بدقة على Together، وكل شيء آخر يمر عبر مفتاح TokenLab واحد. تحتوي صفحة المقارنة الخاصة بنا على المزيد حول التوجيه والتغطية.

ما وراء النص: الصور والفيديو والكود

توثق TokenLab المسارات /v1/images/generations و /v1/videos/generations و /v1/music/generations و /v1/3d/generations. تعيد المهام غير المتزامنة task_id و poll_url، وتتم تسوية الفواتير من خلال billing_transaction_id. تسرد Together نماذج الصور الخاصة بها وتقول إن الفيديو أصلي لـ Together. لم نقارن أسعار الوسائط لأن الأدلة لا تحتوي على أسعار وسائط مطابقة لـ TokenLab. لاختيارات النماذج، راجع أدلتنا لـ أفضل API لنماذج صور AI لعام 2026، و أفضل API لنماذج فيديو AI لعام 2026، و أفضل نماذج AI للبرمجة لعام 2026. توفر الكتالوج، على سبيل المثال kimi-k2.7-code، ليس نتيجة معيارية. اختبر على مهامك الخاصة.

الأسئلة الشائعة

هل يمكنني الاحتفاظ بكود OpenAI SDK الخاص بي عند الانتقال من Together AI إلى TokenLab؟

في الغالب، نعم. قم بتغيير base_url إلى https://api.tokenlab.sh/v1، وقم بتبديل المفتاح، واختر معرف نموذج من GET /v1/models. يقول دليل TokenLab إن كود إعادة المحاولة والمهلة (timeout) والبث (streaming) الحالي يمكنه البقاء عادةً. الحقول الفريدة لتنسيق API آخر غير مضمونة في Chat Completions.

هل تقوم TokenLab بتجاوز الفشل (failover) إلى مزود آخر تلقائياً؟

تصف الوثائق التي قرأناها خيارات التسليم، وليس تجاوز الفشل بين النماذج. يحاول خيار Auto تجربة TokenLab Verified، ثم Official، وأنت تدفع مقابل الخيار الذي يكمل الطلب. إذا لم يكن لدى أي منهما إمداد، ستحصل على 503 delivery_tier_unavailable، وتخبرك retryable ما إذا كان يجب إعادة المحاولة.

هل TokenLab أرخص من Together AI لنفس النموذج؟

ليس دائماً. في 2026-10-03 كان glm-5.2 بسعر 1.4 دولار للإدخال و 4.4 دولار للإخراج على كليهما. كان qwen3.7-plus أقل على Together (0.32 دولار و 1.28 دولار مقابل 0.4 دولار و 1.6 دولار على TokenLab). قارن التكلفة النهائية على عبء عملك الخاص.

هل يجب علي نقل كل حركة المرور الخاصة بي دفعة واحدة؟

لا. تستخدم واجهتا البرمجة روابط قاعدة (base URLs) ومفاتيح منفصلة، لذا يمكنك إرسال عبء عمل واحد عبر TokenLab وترك الباقي على Together. انقل نموذجاً واحداً أولاً وتحقق من تكلفته في الاستخدام (Usage).

قارن عبء عمل Together AI الحالي الخاص بك مقابل TokenLab على صفحة المقارنة، أو اقرأ مقارنة OpenRouter و قائمة النماذج.

المصادر

تم رصد السعر في 2026-10-03

نماذج ذات صلة

النماذج الصادرة حديثًا

ابدأ البناء بالنماذج في هذا الدليل

قارن الأسعار، اختبر المسارات، وحول البحث إلى طلب API يعمل.