اختر Auto أو TokenLab Verified أو Official لكل طلب، مع عرض الأسعار مسبقاً.اطلع على الجديد

أفضل نماذج AI منخفضة التكلفة للوكلاء (Agents): التكلفة وأنماط الفشل

·١٩ سبتمبر ٢٠٢٦·3 دقائق قراءة·آخر تحديث ٢٦ سبتمبر ٢٠٢٦·1514 مشاهدة
#وكلاء الذكاء الاصطناعي#تحسين تكلفة LLM#توجيه النماذج#أدوات المطورين
أفضل نماذج AI منخفضة التكلفة للوكلاء (Agents): التكلفة وأنماط الفشل

في خط أنابيب الوكلاء (agent pipeline) الخاص بنا، نادراً ما يكون النموذج الأرخص لكل token هو النموذج الأرخص لكل مهمة مكتملة. عندما اختبرنا أفضل نماذج الذكاء الاصطناعي الرخيصة للوكلاء، وجدنا أن الـ tokens الناتجة عن استدعاءات الأدوات (tool calls)، وإصلاح JSON، وسلاسل التفكير (chain-of-thought) هي التي تهيمن على الإنفاق. تُعد كل من DeepSeek V4 Flash، وGemini 3.5 Flash، وClaude Sonnet 5، وGPT-5.5، وGLM-5.2، وLaguna XS 2.1 أمثلة حالية على مصدر الحقيقة الوحيد (SSOT) التي يمكننا مناقشتها. أسعار كتالوج TokenLab أدناه هي الأسعار المرصودة بتاريخ 19-09-2026؛ أما الأسعار الخارجية فهي غير مؤرخة وتحتاج إلى تأكيد من المزود. نحن لا ننشر معياراً للأداء (latency benchmark) لأنه لم تكن هناك مجموعة بيانات محكومة لـ TTFT، أو tokens/sec، أو معدل إعادة المحاولة (retry-rate) لهذه المسارات المحددة وقت التحديث. تعامل مع هذا كقائمة مختصرة للتكلفة وأنماط الفشل، ثم قم بقياس الأداء في دورتك الخاصة.

أبرز النقاط

  • تكلفة المخرجات (output cost) تؤثر على إنفاق الوكيل أكثر من تكلفة المدخلات. يولد الوكلاء tokens من خلال استدعاءات الأدوات، وإعادة المحاولات، وJSON أكثر بكثير مما يستهلكونه في كل دورة.
  • من بين أمثلة SSOT الحالية بأسعار كتالوج TokenLab، يُعد DeepSeek V4 Flash هو الخيار الأقل تكلفة للمخرجات الذي يمكننا التحقق منه هنا بسعر 0.147 دولار للمدخلات / 0.294 دولار للمخرجات لكل MTok.
  • تضارب أسماء النماذج أمر واقعي. يظهر DeepSeek V4 Flash بسعريين: 0.147/0.294 دولار في كتالوج TokenLab و0.09/0.18 دولار في قائمة خارجية.
  • تسعير توليد الفيديو والصور (PixVerse, fal, Black Forest Labs) ليس دليلاً على تسعير الـ tokens للنماذج اللغوية الكبيرة (LLM). لا ينبغي أبداً استخدامه كمرجع لتكاليف وكلاء النصوص، وقد قمنا بفصله أدناه.
  • تفتقر أسعار المقارنة الخارجية لكل من Claude Sonnet 5، وGLM-5.2، وKimi K2.7 Code، وQwen3.7 Plus، وغيرها إلى رابط مصدر عام مؤرخ. قم بتأكيدها مقابل صفحة الأسعار الخاصة بكل مزود قبل وضع ميزانيتك.
  • الأرخص لكل token ليس بالضرورة الأرخص لكل مهمة. النموذج الذي يفشل في استدعاءات الأدوات أو يقطع JSON يفرض عمليات إعادة محاولة، مما يمحو أي وفورات.

لقطة المصدر وأنماط الفشل

المصدر نوع المحتوى تاريخ الرصد مدى الصلة بهذا المقال
وثائق منصة PixVerse (docs.platform.pixverse.ai) تسعير توليد الفيديو 08-07-2026 لا يُستخدم لمطالبات LLM - مخصص للفيديو فقط، أُدرج للشفافية
صفحة نموذج fal PixVerse V6 (fal.ai/pixverse-v6) تسعير توليد الفيديو 08-07-2026 لا يُستخدم لمطالبات LLM - مخصص للفيديو فقط
وثائق تسعير Black Forest Labs (docs.bfl.ml) تسعير توليد الصور 08-07-2026 لا يُستخدم لمطالبات LLM - مخصص للصور فقط
كتالوج النماذج الداخلي لـ TokenLab تسعير LLM والوسائط الخاص بالطرف الأول 19-09-2026 المصدر الرئيسي لجميع أسعار كتالوج TokenLab أدناه
صفحات تسعير المزودين الأفراد (OpenAI, Anthropic, Google, DeepSeek, Moonshot, Qwen, MiniMax, Z.ai) تسعير LLM غير مؤرخ في هذه المجموعة يجب التحقق منها بشكل مستقل قبل تقديم مطالبات الميزانية العامة

توجد مصادر PixVerse وfal وBFL في مجموعة أبحاثنا لأننا سحبناها أثناء مسح أوسع لتسعير الوسائط. وهي تصف فوترة الفيديو لكل ثانية وتكاليف الائتمان لكل صورة، والتي ليس لها أي علاقة بتسعير LLM لكل token. ندرجها هنا حتى يتمكن القراء من معرفة سبب استبعادنا لها. نحن لا نستخدمها لأي مطالبات تتعلق بـ LLM.

في خط أنابيبنا، نقوم بتسجيل معدلات إعادة محاولة استدعاء الأدوات، وJSON المقطوع، واستدعاءات الأدوات الفاشلة، وحجج الوظائف المهلوسة (hallucinated function arguments) جنباً إلى جنب مع إنفاق الـ tokens. لا نملك مجموعة بيانات محكومة لمعدلات إعادة المحاولة لهذه المسارات المحددة وقت التحديث، لذا لا يمكننا نشر المعدلات. على سبيل المثال، نموذج بسعر 0.05 دولار/MTok يفشل في 15% من استدعاءات الأدوات قد يكلف في عمليات إعادة المحاولة أكثر من نموذج بسعر 1 دولار/MTok يفشل في 2% فقط. هذه الحسابات المتعلقة بأنماط الفشل، وليس السعر المعلن، هي التي يجب أن توجه اختيارك للفئة الرخيصة.

مقارنة النماذج والتكلفة لأفضل نماذج الذكاء الاصطناعي الرخيصة للوكلاء

جميع الأسعار أدناه هي قوائم كتالوج TokenLab الخاصة (لكل token، معبر عنها بـ $/MTok)، المرصودة بتاريخ 19-09-2026. وهي الأساس الصحيح لمطالبات تكلفة وكلاء LLM في هذا المقال.

النموذج المزود المدخلات $/MTok المخرجات $/MTok مدى ملاءمة الوكيل
DeepSeek V4 Flash DeepSeek $0.147 $0.294 أرخص خيار SSOT حالي كثيف المخرجات في كتالوج TokenLab؛ تأكد من معرف النموذج الدقيق قبل المقارنة مع الأسعار الخارجية
Gemini 3.5 Flash Google $1.50 $9.00 خطوات الوكيل متعدد الوسائط (استخدام أدوات الصور + النصوص)
Claude Sonnet 5 Anthropic $2.00 $10.00 يُحفظ للتحقق النهائي/مرحلة ضمان الجودة لمخرجات الوكيل
GPT-5.5 OpenAI $5.00 $30.00 خيار احتياطي للتخطيط المعقد أو اختيار الأدوات الغامض
Claude Opus 4.8 Anthropic $5.00 $25.00 مقارنة رائدة؛ نادراً ما يتم تبريرها داخل حلقة الوكيل
Claude Fable 5 Anthropic $10.00 $50.00 السقف المميز
GLM-5.2 Z.ai $0.93 $3.00 مثال على الأوزان المفتوحة للتوجيه منخفض التكلفة
Kimi K2.7 Code Moonshot AI $0.74 $3.50 مثال على وكيل البرمجة
Qwen3.7 Plus Alibaba/Qwen $0.32 $1.28 مثال على التوجيه منخفض التكلفة
MiniMax M3 MiniMax $0.30 $1.20 مثال على التوجيه منخفض التكلفة
DeepSeek V4 Pro DeepSeek $0.441 $0.882 مهام فرعية أكثر تعقيداً في التفكير ضمن نفس العائلة

نحتفظ بالأرقام الخارجية أدناه لاستمرارية التدقيق ونميز كل صف على أنه غير مؤكد. لا تستخدمها للميزانية. يجب تأكيد التفاصيل الدقيقة مقابل الوثائق الحالية.

النموذج المزود المدخلات $/MTok المخرجات $/MTok حالة التحقق
DeepSeek V4 Flash (قائمة خارجية) DeepSeek $0.09 $0.18 يختلف عن كتالوج TokenLab أعلاه - تأكد من المنتج/الفئة التي يشير إليها؛ لا يوجد رابط مصدر مؤرخ في مجموعة مصادرنا
MiniMax M3 MiniMax $0.30 $1.20 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
Qwen3.7 Plus Alibaba/Qwen $0.32 $1.28 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
Kimi K2.7 Code Moonshot AI $0.74 $3.50 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
GLM-5.2 Z.ai $0.93 $3.00 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
Claude Sonnet 5 Anthropic $2.00 $10.00 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
Claude Opus 4.8 Anthropic $5.00 $25.00 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
GPT-5.5 Batch/Flex OpenAI $2.50 $15.00 لا يوجد رابط مصدر مؤرخ؛ ليس صف GPT-5.5 القياسي
GPT-5.5 OpenAI $5.00 $30.00 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود
Claude Fable 5 Anthropic $10.00 $50.00 لا يوجد رابط مصدر مؤرخ؛ تأكد من وثائق المزود

نقاط أسعار الكتالوج المتقاعدة لم تعد تطابق اسم نموذج SSOT حالي. نحن نحتفظ بالأرقام لاستمرارية التدقيق، لكننا لا نوجه عمل وكيل جديد إلى هذه الفئات غير المسماة دون تأكيد من المزود.

فئة متقاعدة أو غير SSOT المدخلات $/MTok المخرجات $/MTok الحالة
فئة متقاعدة منخفضة التكلفة للغاية $0.05 $0.40 لم تعد مثالاً حالياً لـ SSOT؛ تأكد من البديل قبل الاستخدام
فئة متقاعدة منخفضة التكلفة flash-lite $0.25 $1.50 لم تعد مثالاً حالياً لـ SSOT؛ قم بالربط بـ Gemini 3.5 Flash أو DeepSeek V4 Flash وتأكد
فئة متقاعدة منخفضة التكلفة mini $0.25 $2.00 لم تعد مثالاً حالياً لـ SSOT؛ قم بالربط بـ Claude Sonnet 5 أو DeepSeek V4 Flash وتأكد
فئة متقاعدة للتحقق الصغير $1.00 $5.00 لم تعد مثالاً حالياً لـ SSOT؛ قم بالربط بـ Claude Sonnet 5 وتأكد
فئة متقاعدة احتياطية متوسطة $1.25 $10.00 لم تعد مثالاً حالياً لـ SSOT؛ قم بالربط بـ GPT-5.5 وتأكد
سقف متقاعد ممتاز $15.00 $120.00 لم تعد مثالاً حالياً لـ SSOT؛ قم بالربط بـ GPT-5.5 أو Claude Fable 5 وتأكد

ملاحظات التنفيذ لأفضل نماذج الذكاء الاصطناعي الرخيصة للوكلاء

  1. صنف وكيلك حسب المهمة، وليس حسب نموذج واحد أرخص. وجه التوجيه، والتصنيف، واختيار الأدوات إلى DeepSeek V4 Flash أو Gemini 3.5 Flash. صعد التخطيط متعدد الخطوات إلى DeepSeek V4 Pro أو GPT-5.5. احتفظ بـ Claude Sonnet 5 للتحقق من الإجابة النهائية.
  2. ضع حداً أقصى لـ tokens المخرجات بقوة في الفئة الرخيصة. نظراً لأن تكلفة المخرجات تهيمن على إنفاق الوكيل، ضع حدوداً صارمة لـ max-token على استدعاءات DeepSeek V4 Flash وGemini 3.5 Flash. اسمح فقط بعمليات توليد أطول في فئة التصعيد.
  3. سجل أنماط الفشل لكل نموذج، وليس فقط التكلفة لكل استدعاء. تتبع JSON المقطوع، واستدعاءات الأدوات الفاشلة، وحجج الوظائف المهلوسة بشكل منفصل عن إنفاق الـ tokens. على سبيل المثال، نموذج بسعر 0.05 دولار/MTok يفشل في 15% من استدعاءات الأدوات قد يكلف في عمليات إعادة المحاولة أكثر من نموذج بسعر 1 دولار/MTok يفشل في 2% فقط.
  4. ثبّت معرفات النماذج الدقيقة في الكود، ولا تستخدم الأسماء المستعارة أبداً. بالنظر إلى تضارب التسمية الموضح أعلاه (سعران مختلفان لـ DeepSeek V4 Flash)، قم بترميز سلسلة المورد والنموذج الكاملة. أعد التحقق من التسعير عند كل تحديث للمزود.
  5. أعد فحص التسعير الخارجي ربع سنوياً. أي شيء لا يحتوي على رابط مصدر مؤرخ في هذا المقال يجب إعادة سحبه من صفحة التسعير المباشرة للمزود قبل أن يظهر في تقدير التكلفة الموجه للعملاء.

إليك مخطط توجيه يستخدم أسماء نماذج الكتالوج في هذا المقال. يجب تأكيد شكل طلب TokenLab وحقول خطأ استدعاء الأداة في وثائق API الخاصة بـ TokenLab قبل الاستخدام في الإنتاج.

Routing sketch, not a TokenLab API contract. Confirm the request shape in the TokenLab API docs.
for model in ['DeepSeek V4 Flash', 'Gemini 3.5 Flash', 'Claude Sonnet 5']:
    retry once if the tool call is missing or the JSON is truncated
    if the response contains a valid tool call and valid JSON:
        return the response
    log the failure mode for this model
raise an error after the final tier fails

يوضح هذا المخطط حدود إعادة المحاولة: التقاط خطأ استدعاء الأداة، وتسجيل نمط الفشل، ثم الانتقال إلى النموذج التالي. تأكد من شكل الطلب وحقول الخطأ في وثائق API الحالية لـ TokenLab قبل الإنتاج.

أين يتناسب TokenLab مع توجيه الوكلاء

  • كتالوج واحد يقلل من التلاعب بحسابات الموردين. يعرض TokenLab فئات تسعير OpenAI، وGoogle، وAnthropic، وDeepSeek تحت واجهة API وفوترة واحدة. يصبح تبديل خطوة سير العمل من DeepSeek V4 Flash إلى Gemini 3.5 Flash تغييراً في الإعدادات، وليس تكاملاً جديداً.
  • تسعير مؤرخ من الطرف الأول يمكنك تدقيقه. على عكس أسعار الطرف الثالث المتناثرة، يتم سحب أرقام كتالوج TokenLab في هذا المقال من قوائم المنصة نفسها المرصودة بتاريخ 19-09-2026. ولهذا السبب فهي الأسعار الوحيدة هنا المقدمة دون تحذير "يجب التحقق".
  • تصنيف مدمج لخطوط أنابيب الوكلاء. نظراً لأن TokenLab يستضيف نماذج الفئة الرخيصة وفئة التصعيد جنباً إلى جنب، يمكنك إجراء اختبار A/B للتكلفة ومعدل الفشل عبر DeepSeek V4 Flash، وGemini 3.5 Flash، وClaude Sonnet 5. لست بحاجة إلى إعادة تصميم منطق توجيه وكيلك.

قراءة ذات صلة

الأسئلة الشائعة

لماذا أرى سعرين لـ DeepSeek V4 Flash؟

يظهر DeepSeek V4 Flash بسعريين في مجموعة مصادرنا: 0.147/0.294 دولار في كتالوج TokenLab و0.09/0.18 دولار في قائمة خارجية. يتم إعادة استخدام أسماء النماذج وإعادة تسعيرها عبر المزودين والبائعين. ثبّت معرف المورد والنموذج الدقيق في الكود، ثم أعد التحقق مقابل الوثائق المباشرة للمزود بدلاً من الوثوق بالاسم وحده.

هل يمكنني استخدام أسعار المرجع الخارجية للميزانية؟

ليس بعد. تفتقر تلك الصفوف إلى رابط مصدر مؤرخ في مجموعة مصادرنا، لذا قمنا بتمييزها على أنها تحتاج إلى تأكيد من المزود. أرقام كتالوج TokenLab هي أساس التخطيط، والجدول الخارجي هو نقطة بداية للتحقق الخاص بك، وليس رقماً نهائياً. يجب تأكيد التفاصيل الدقيقة مقابل الوثائق الحالية.

أي نموذج SSOT حالي هو الأرخص لوكيل الإنتاج؟

من حيث تكلفة المخرجات بين أمثلة SSOT الحالية بأسعار كتالوج TokenLab، يُعد DeepSeek V4 Flash هو الأقل الذي يمكننا التحقق منه هنا بسعر 0.294 دولار/MTok للمخرجات. تظهر القائمة الخارجية 0.18 دولار/MTok للمخرجات، لكن هذا الرقم يحتاج إلى تأكيد من المزود. قس الأرخص بعد حساب معدل إعادة المحاولة على مخطط استدعاء الأداة الخاص بك.

لماذا يتم الاستشهاد بـ PixVerse وfal وBFL إذا كان هذا المقال عن تسعير LLM؟

لا يتم الاستشهاد بها كدليل على أي مطالبة بسعر LLM. فهي تظهر فقط في جدول "لقطة المصدر" للشفافية حول مسح أبحاثنا الأوسع، وتم تمييزها صراحة بأنها غير مستخدمة لمطالبات LLM. كل رقم دولار في جدول "مقارنة النماذج والتكلفة" يأتي من كتالوج TokenLab نفسه أو تم تمييزه على أنه غير مؤكد.

كيف تغير عمليات إعادة محاولة استدعاء الأدوات اختيار النموذج الأرخص؟

النموذج الرخيص الذي يفشل في استدعاء الأدوات أو يقطع JSON يفرض عمليات إعادة محاولة، وتضيف عمليات إعادة المحاولة هذه tokens مخرجات. على سبيل المثال، نموذج بسعر 0.05 دولار/MTok يفشل في 15% من استدعاءات الأدوات قد يكلف في عمليات إعادة المحاولة أكثر من نموذج بسعر 1 دولار/MTok يفشل في 2% فقط. في خط أنابيبنا، نقوم بتسجيل معدلات إعادة المحاولة لكل نموذج ومقارنة التكلفة لكل مهمة مكتملة، وليس التكلفة لكل token.

استكشف كتالوج نماذج TokenLab وابدأ في مقارنة التكاليف اليوم: كتالوج نماذج TokenLab.

المصادر

تم رصد السعر في 2026-07-07

نماذج ذات صلة

النماذج الصادرة حديثًا

ابدأ البناء بالنماذج في هذا الدليل

قارن الأسعار، اختبر المسارات، وحول البحث إلى طلب API يعمل.