اختر Auto أو TokenLab Verified أو Official لكل طلب، مع عرض الأسعار مسبقاً.اطلع على الجديد

Alibaba: CosyVoice v3.5 Plus

يحول CosyVoice v3.5 Plus النصوص المكتوبة إلى كلام معبر. استخدمه للمقالات المروية، والتعليقات الصوتية الحوارية، وتوجيهات المنتجات المنطوقة، مع اختيار الصوت وسرعة التحدث بما يناسب الجمهور.
مقارنة النماذج
cosyvoice-v3.5-plus
متاحAlibabaتحويل النص إلى كلاممتزامن
الإدخال / الإخراج
$22.06 / $0.00
الأنماط
صوت

عن CosyVoice v3.5 Plus

CosyVoice v3.5 Plus هو نموذج تركيب الكلام من Alibaba للأصوات التي تنشئها بنفسك. لا يحتوي على قائمة أصوات جاهزة: يمكنك استنساخ صوت من عينة أو تصميم صوت من وصف نصي، ثم التركيب به عبر اتصال WebSocket. يتحدث النموذج الماندرين، والإنجليزية، والعديد من اللغات الأخرى، بالإضافة إلى العديد من اللهجات الإقليمية الصينية، ويقبل تعليمات باللغة الطبيعية لتوجيه طريقة الإلقاء، وهو ما لا يوفره Qwen3-TTS-Flash.

نقاط القوة

  • يعمل مع أصوات مستنسخة من تسجيل أو أصوات مصممة بناءً على وصف مكتوب.
  • يقبل تعليمات للتحكم في النبرة وأسلوب التحدث.
  • يتحدث الماندرين، والكانتونية، والعديد من اللهجات الإقليمية الصينية، بالإضافة إلى الإنجليزية، والفرنسية، والألمانية، واليابانية، والكورية، والروسية، والبرتغالية، والتايلاندية، والإندونيسية، والفيتنامية.
  • يبث الصوت عبر WebSocket، بحيث يمكن أن يبدأ التشغيل قبل اكتمال التركيب.

متى تستخدم نموذجاً آخر

  • لا يحتوي على أصوات نظام مدمجة؛ يجب عليك إنشاء صوت مستنسخ أو مصمم أولاً.
  • يتطلب عميل WebSocket بدلاً من طلب HTTP بسيط.
  • يتطلب استنساخ الصوت عينة مرجعية واضحة وموافقة على استخدام ذلك الصوت.

البدء

  1. إنشاء مفتاح API

    أنشئ مفتاح في Console واستخدمه مع جميع النماذج على المنصة.

  2. إرسال طلبك الأول

    انسخ المثال الخاص بلغة البرمجة التي تستخدمها وقم بتشغيله مقابل نقطة النهاية (endpoint).

    تحويل النص إلى كلامنقطة اتصال TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "cosyvoice-v3.5-plus",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

التسعير

السعر الرسمي هو السعر الأساسي العام من صانع النموذج. سعر TokenLab هو ما تدفعه فعلياً لهذا النموذج على TokenLab.

Cosy Tts Number

لكل مليون حرف
السعر الرسمي
المدخلات $22.06 / المخرجات $0.00
Official
المدخلات $22.06 / المخرجات $0.00
خصم
—

الاستخدام والنشاط

معدل النجاح هو نسبة الطلبات المكتملة. زمن الاستجابة هو مدة الاستجابة الكاملة؛ ويعني P95 أن 95% من الطلبات اكتملت ضمن ذلك الوقت.

الاستخدام والتوفر

آخر 24 ساعة
الطلبات
معدل النجاح
زمن الاستجابة P95
إجمالي الرموز
أداء النموذج
تظهر المقاييس بمجرد استيفاء حدود الخصوصية وحجم البيانات.

تستند البيانات إلى طلبات المستخدمين المجمعة، باستثناء عمليات التحقق من الحالة.

فتح في Console

افتح CosyVoice v3.5 Plus في Console وجهز الرسالة للتعديل أو الإرسال.

ساعدني في تجربة cosyvoice-v3.5-plus بطلب صوتي قصير في /v1/audio/speech. اعرض النتيجة والتكلفة.

حالات الاستخدام

  • صوت العلامة التجارية

    استنسخ متحدثاً معتمداً مرة واحدة واستخدم الصوت لجولات المنتج، ومطالبات الرد الصوتي التفاعلي (IVR)، والإعلانات.

  • أصوات الشخصيات

    صمم صوتاً من وصف، مثل راوٍ مسن ودافئ، للكتب الصوتية أو الألعاب.

  • السرد باللهجات الإقليمية

    إنتاج محتوى منطوق بلهجات سيتشوان، أو شنغهاي، أو الكانتونية للجماهير المحلية.

أمثلة Prompt

اقرأ هذا الإعلان بنبرة سريعة ومبهجة، مع توقف قصير بعد التاريخ.

انطق الفقرة التالية ببطء ودفء، كما لو كنت تقرأ قصة قبل النوم.

قل هذا بالكانتونية بإيقاع مريح وتفاعلي.

FAQ

هل يحتوي CosyVoice v3.5 Plus على أصوات مسبقة الضبط؟

لا. لا تدرج Alibaba أي أصوات نظام لهذا النموذج. تحتاج إلى صوت مستنسخ من عينة أو صوت مصمم من وصف نصي، ثم تمرير ذلك الصوت عند التركيب.

ما اللغات واللهجات التي يدعمها؟

الماندرين، والكانتونية، والعديد من اللهجات الإقليمية الصينية، بالإضافة إلى الإنجليزية، والفرنسية، والألمانية، واليابانية، والكورية، والروسية، والبرتغالية، والتايلاندية، والإندونيسية، والفيتنامية. دعم اللهجات هو فرق رئيسي عن نماذج Qwen3-TTS-Flash.

هل يمكنني التحكم في كيفية صوته؟

نعم. يدعم النموذج التحكم عبر التعليمات، لذا يمكنك وصف النبرة، أو العاطفة، أو الإيقاع باللغة الطبيعية. اختيار الصوت يحدد من يتحدث؛ والتعليمات تشكل كيفية إلقاء الجملة.

كيف يتم استدعاؤه؟

من خلال واجهة برمجة تطبيقات WebSocket التي تبث الصوت أثناء توليده. هذا يناسب النصوص الطويلة والتشغيل المباشر، لكنك ستحتاج إلى عميل يتعامل مع الاتصال.

متى يجب أن أختار Qwen3-TTS-Flash بدلاً منه؟

عندما تريد أصواتاً جاهزة وطلب HTTP بسيطاً ولا تحتاج إلى استنساخ أو تعليمات. اختر CosyVoice عندما تكون هوية الصوت أو أسلوب الإلقاء جزءاً من منتجك.

كم تكلفة CosyVoice v3.5 Plus؟

على TokenLab تكلف CosyVoice v3.5 Plus المدخلات $22.06 / المخرجات $0.00 لكل مليون حرف. التفاصيل الكاملة في جدول التسعير أعلاه. تعتمد الأسعار على وحدة الفوترة والمواصفات والاستخدام. قارن بين الشروط المتطابقة في التسعير التفصيلي للنموذج؛ السعر الواحد لا يحدد التكلفة الإجمالية.

ما نقطة النهاية التي يجب أن يستخدمها CosyVoice v3.5 Plus؟

استخدم https://api.tokenlab.sh/v1/audio/speech كافتراضي لـ CosyVoice v3.5 Plus. إذا كانت الصيغة الأصلية للمزود مدعومة فإن API workbench يعرضها أيضاً.

ما العمليات التي يدعمها CosyVoice v3.5 Plus؟

CosyVoice v3.5 Plus يدعم تحويل النص إلى كلام. اختر عملية في API workbench أعلاه لرؤية نقطة النهاية وعينة الكود المطابقة.

مقارنة CosyVoice v3.5 Plus

المصادر

تمت المراجعة في ٠٢‏/١٠‏/٢٠٢٦

نماذج ذات صلة