اختر Auto أو TokenLab Verified أو Official لكل طلب، مع عرض الأسعار مسبقاً.اطلع على الجديد

Alibaba: Qwen3-TTS 1.7B CustomVoice

Qwen3-TTS 1.7B CustomVoice هو نموذج تحويل النص إلى كلام من Alibaba يقدم تسعة أجراس صوتية مسبقة الضبط ومتميزة عبر مجموعات متنوعة من الجنس، والعمر، واللغة، واللهجة. يوفر تحكماً دقيقاً في أسلوب الأصوات المستهدفة من خلال تعليمات المستخدم، ويدعم استنساخ الصوت من عينة مدتها 3 ثوانٍ، ويولد الكلام بأكثر من 10 لغات مع زمن انتقال منخفض يصل إلى 97 مللي ثانية.
مقارنة النماذج
qwen3-tts-1-7b-customvoice
متاحAlibabaتحويل النص إلى كلاممتزامن
السعر
ابتداءً من $0.000015
الأنماط
صوت

عن Qwen3-TTS 1.7B CustomVoice

نموذج Qwen3-TTS 1.7B CustomVoice هو نموذج تحويل النص إلى كلام من شركة Alibaba، مبني حول مجموعة ثابتة من تسعة أصوات محددة مسبقاً. يمكنك اختيار المتحدث بالاسم وإضافة تعليمات بلغة بسيطة حول النبرة أو العاطفة أو أسلوب التحدث. يتحدث النموذج عشر لغات، بما في ذلك الصينية والإنجليزية واليابانية والكورية والعديد من اللغات الأوروبية، وتذكر Alibaba أن زمن انتقال التوليف من البداية إلى النهاية يصل إلى 97 مللي ثانية للاستخدام التفاعلي.

نقاط القوة

  • تغطي الأصوات التسعة المميزة والمحددة بالاسم أجناسًا وأعمارًا ولغات ولهجات مختلفة، مما يسمح للصوت بالبقاء ثابتًا عبر المنتج بالكامل.
  • يمكن للتعليمات المكتوبة توجيه العاطفة وأسلوب التحدث دون تغيير المتحدث المختار.
  • يتم دعم عشر لغات: الصينية، الإنجليزية، اليابانية، الكورية، الألمانية، الفرنسية، الروسية، البرتغالية، الإسبانية، والإيطالية.
  • تفيد Alibaba بأن زمن الانتقال من البداية إلى النهاية يصل إلى 97 مللي ثانية، وهو ما يناسب المساعدين الصوتيين والسرد المباشر.

متى تستخدم نموذجاً آخر

  • قائمة الأصوات ثابتة؛ لابتكار صوت جديد من خلال الوصف، يعد متغير VoiceDesign هو الخيار الأنسب.
  • تكون النتائج أفضل عندما يقرأ المتحدث لغته الأم، لذا قد يبدو الصوت المضبوط مسبقاً بالإنجليزية بلكنة عند قراءة اليابانية.
  • النصوص المدخلة الصاخبة أو غير العادية، مثل الترميز المكثف أو الرموز المختلطة، قد تقلل من جودة المخرجات.

البدء

  1. إنشاء مفتاح API

    أنشئ مفتاح في Console واستخدمه مع جميع النماذج على المنصة.

  2. إرسال طلبك الأول

    انسخ المثال الخاص بلغة البرمجة التي تستخدمها وقم بتشغيله مقابل نقطة النهاية (endpoint).

    تحويل النص إلى كلامنقطة اتصال TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "model": "qwen3-tts-1-7b-customvoice",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

التسعير

السعر الرسمي هو السعر الأساسي العام من صانع النموذج. سعر TokenLab هو ما تدفعه فعلياً لهذا النموذج على TokenLab.

تحويل النص إلى كلام

لكل مليون حرف
السعر الرسمي
$0.000015
Official
$0.000015
خصم
—

الاستخدام والنشاط

معدل النجاح هو نسبة الطلبات المكتملة. زمن الاستجابة هو مدة الاستجابة الكاملة؛ ويعني P95 أن 95% من الطلبات اكتملت ضمن ذلك الوقت.

الاستخدام والتوفر

آخر 24 ساعة
الطلبات
معدل النجاح
زمن الاستجابة P95
إجمالي الرموز
أداء النموذج
تظهر المقاييس بمجرد استيفاء حدود الخصوصية وحجم البيانات.

تستند البيانات إلى طلبات المستخدمين المجمعة، باستثناء عمليات التحقق من الحالة.

فتح في Console

افتح Qwen3-TTS 1.7B CustomVoice في Console وجهز الرسالة للتعديل أو الإرسال.

ساعدني في تجربة qwen3-tts-1-7b-customvoice بطلب صوتي قصير في /v1/audio/speech. اعرض النتيجة والتكلفة.

حالات الاستخدام

  • المساعدون الصوتيون

    امنح المساعد داخل التطبيق صوتاً واحداً ثابتاً ومحدداً مع تأخير استجابة منخفض لتبدأ الردود في التشغيل بسرعة بعد أن يصبح النص جاهزاً.

  • سرد الكتب الصوتية والمقالات

    اقرأ نصاً طويلاً باستخدام متحدث مختار وأضف تعليمات مثل "هادئ ودافئ" للحفاظ على اتساق الأداء عبر الفصول.

  • مقاطع فيديو المنتجات المترجمة محلياً

    استخدم الإعدادات المسبقة باللغات اليابانية أو الكورية أو الإنجليزية لتقديم النص نفسه لكل سوق مع الحفاظ على صوت العلامة التجارية المميز.

  • حوارات الألعاب والشخصيات

    اختر إعدادات مسبقة مميزة لشخصيات مختلفة وأضف تعليمات عاطفية للخطوط الغاضبة أو المتعبة أو المتحمسة.

أمثلة Prompt

المتحدث: Ryan. التعليمات: هادئ، ودود، بطيء قليلاً. النص: مرحباً بعودتك. تم شحن طلبك ومن المفترض أن يصل يوم الخميس.

المتحدث: Ono_Anna. التعليمات: مذيع مبتهج. النص: 本日はご来店いただき、ありがとうございます。

المتحدث: Vivian. التعليمات: همس، كما لو كنت تخبر سراً. النص: 你听说了吗?明天会有一个大消息。

FAQ

ما هي الأصوات التي يوفرها Qwen3-TTS CustomVoice؟

تسعة إعدادات مسبقة: Vivian وSerena وUncle_Fu وDylan وEric للمتغيرات الصينية، وRyan وAiden للإنجليزية، وOno_Anna لليابانية، وSohee للكورية. تختار واحداً بالاسم لكل طلب.

هل يمكنني التحكم في العاطفة وأسلوب التحدث؟

نعم. يمكنك إضافة تعليمات بلغة طبيعية، على سبيل المثال "غاضب" أو "لطيف" أو "سريع ومتحمس"، وسيقوم النموذج بضبط النبرة والأسلوب مع الحفاظ على جرس صوت المتحدث المختار.

كيف يختلف CustomVoice عن VoiceDesign؟

يستخدم CustomVoice تسعة متحدثين ثابتين تختار من بينهم. بينما لا يحتوي VoiceDesign على قائمة محددة مسبقاً؛ بل تصف الصوت الذي تريده بالكلمات، مثل العمر والمزاج وطبقة الصوت، ويقوم النموذج بإنشائه. اختر CustomVoice للاتساق وVoiceDesign للأصوات الجديدة.

ما هي اللغات التي يتحدث بها؟

عشر لغات: الصينية، الإنجليزية، اليابانية، الكورية، الألمانية، الفرنسية، الروسية، البرتغالية، الإسبانية، والإيطالية. تنصح بطاقة النموذج باستخدام كل متحدث بلغته الأم للحصول على أفضل جودة.

هل هو سريع بما يكفي للمحادثة المباشرة؟

تذكر Alibaba أن زمن انتقال التوليف من البداية إلى النهاية يصل إلى 97 مللي ثانية، وهو مخصص للاستخدام في الوقت الفعلي. يعتمد التأخير الفعلي في تطبيقك أيضاً على مسافة الشبكة وطول النص، لذا قم بقياسه باستخدام حركة المرور الخاصة بك.

كم تكلفة Qwen3-TTS 1.7B CustomVoice؟

على TokenLab تكلف Qwen3-TTS 1.7B CustomVoice - . التفاصيل الكاملة في جدول التسعير أعلاه. تعتمد الأسعار على وحدة الفوترة والمواصفات والاستخدام. قارن بين الشروط المتطابقة في التسعير التفصيلي للنموذج؛ السعر الواحد لا يحدد التكلفة الإجمالية.

ما نقطة النهاية التي يجب أن يستخدمها Qwen3-TTS 1.7B CustomVoice؟

استخدم https://api.tokenlab.sh/v1/audio/speech كافتراضي لـ Qwen3-TTS 1.7B CustomVoice. إذا كانت الصيغة الأصلية للمزود مدعومة فإن API workbench يعرضها أيضاً.

ما العمليات التي يدعمها Qwen3-TTS 1.7B CustomVoice؟

Qwen3-TTS 1.7B CustomVoice يدعم تحويل النص إلى كلام. اختر عملية في API workbench أعلاه لرؤية نقطة النهاية وعينة الكود المطابقة.

مقارنة Qwen3-TTS 1.7B CustomVoice

المصادر

تمت المراجعة في ٠٢‏/١٠‏/٢٠٢٦

المزيد من Qwen TTS

نماذج ذات صلة