اختر Auto أو TokenLab Verified أو Official لكل طلب، مع عرض الأسعار مسبقاً.اطلع على الجديد

Alibaba: Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15 هو إصدار قديم للتعرف على الكلام لنسخ الملفات الصوتية. تثبيت هذا الإصدار مفيد عندما يحتاج خط أنابيب النسخ إلى اختيار نموذج متسق عبر عمليات المعالجة المتكررة.
مقارنة النماذج
fun-asr-flash-2026-06-15
متاحAlibabaتحويل الكلام إلى نص (Speech to Text)متزامن
السعر
ابتداءً من $0.000035
الأنماط
صوت

عن Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15 هو إصدار مؤرخ من نموذج التعرف على الكلام Flash الخاص بشركة Alibaba، والذي تطرحه Alibaba تحت اسم Qwen-Audio-3.0-ASR-Flash. يقوم النموذج بنسخ ملفات الصوت القصيرة عبر استدعاء HTTP متزامن، ويأخذ أجزاء المحادثة السابقة كسياق لتوجيه عملية التعرف. يؤدي تثبيت المعرف المؤرخ إلى إبقاء خط المعالجة على إصدار واحد، على عكس الاسم المستعار غير المؤرخ الذي قد يتم تحديثه.

نقاط القوة

  • يقبل أجزاء المحادثة السابقة إلى جانب الصوت، بحيث توجه المفردات المستخدمة في النقاش الجاري عملية التعرف.
  • تدرج Alibaba الطوابع الزمنية على مستوى الكلمات وحدود الجمل في نفس الاستجابة المتزامنة.
  • يعمل التاريخ الموجود في المعرف على تثبيت إصدار واحد، مما يجعل عمليات التشغيل المتكررة قابلة للمقارنة.

متى تستخدم نموذجاً آخر

  • تقتصر المقاطع على حوالي خمس دقائق، لذا تتطلب التسجيلات الطويلة استخدام Fun-ASR غير المتزامن أو نموذج filetrans.
  • يتعامل النموذج مع المقاطع الجاهزة فقط؛ أما بالنسبة للترجمة الفورية أو الإملاء، فإن Fun-ASR Realtime هو النموذج المخصص للبث المباشر.

البدء

  1. إنشاء مفتاح API

    أنشئ مفتاح في Console واستخدمه مع جميع النماذج على المنصة.

  2. إرسال طلبك الأول

    انسخ المثال الخاص بلغة البرمجة التي تستخدمها وقم بتشغيله مقابل نقطة النهاية (endpoint).

    صوت إلى نصنقطة اتصال TokenLab
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr-flash-2026-06-15" \
      -F language="en"

التسعير

السعر الرسمي هو السعر الأساسي العام من صانع النموذج. سعر TokenLab هو ما تدفعه فعلياً لهذا النموذج على TokenLab.

صوت إلى نص

لكل ثانية
السعر الرسمي
$0.000035
Official
$0.000035
خصم
—

الاستخدام والنشاط

معدل النجاح هو نسبة الطلبات المكتملة. زمن الاستجابة هو مدة الاستجابة الكاملة؛ ويعني P95 أن 95% من الطلبات اكتملت ضمن ذلك الوقت.

الاستخدام والتوفر

آخر 24 ساعة
الطلبات
معدل النجاح
زمن الاستجابة P95
إجمالي الرموز
أداء النموذج
تظهر المقاييس بمجرد استيفاء حدود الخصوصية وحجم البيانات.

تستند البيانات إلى طلبات المستخدمين المجمعة، باستثناء عمليات التحقق من الحالة.

فتح في Console

افتح Fun-ASR Flash 2026-06-15 في Console وجهز الرسالة للتعديل أو الإرسال.

ساعدني في تجربة fun-asr-flash-2026-06-15 بطلب صوتي قصير في /v1/audio/transcriptions. اعرض النتيجة والتكلفة.

حالات الاستخدام

  • الملاحظات الصوتية

    نسخ الملاحظات والرسائل المسجلة القصيرة في طلب واحد، دون الحاجة إلى وضعها في قائمة انتظار لعملية غير متزامنة.

  • الإملاء الطبي

    مرر الحوار السابق كسياق لزيادة احتمالية التعرف على أسماء الأدوية والمصطلحات السريرية.

  • خطوط معالجة الاختبار المثبتة

    الحفاظ على ثبات الإصدار أثناء مقارنة تغييرات التلخيص اللاحقة مقابل نفس النصوص المنسوخة.

أمثلة Prompt

انسخ هذا التسجيل الطبي الذي تبلغ مدته 3 دقائق؛ السياق: الجزء السابق ناقش جرعة الميتفورمين.

انسخ هذه الملاحظة الصوتية لمهندس ميداني حول عطل في وحدة التحكم المنطقية القابلة للبرمجة (PLC) وأرجع الطوابع الزمنية للكلمات.

انسخ مقطع مكالمة العميل القصير هذا، باستخدام أجزاء المحادثة السابقة كسياق.

FAQ

ماذا يعني التاريخ في fun-asr-flash-2026-06-15؟

إنه يحدد إصداراً معيناً، 15 يونيو 2026. استدعاء المعرف المؤرخ يبقي خط المعالجة الخاص بك على ذلك الإصدار. تقدمه Alibaba تحت اسم Qwen-Audio-3.0-ASR-Flash.

ما هي المدة التي يمكن أن يستغرقها المقطع الصوتي؟

توثق Alibaba حداً أقصى يبلغ حوالي خمس دقائق لكل استدعاء، بملفات تصل إلى 2 جيجابايت. بالنسبة للتسجيلات الأطول، استخدم Fun-ASR أو Qwen3 ASR Flash Filetrans، وكلاهما يقبل مهام الملفات غير المتزامنة.

هل يمكنني تزويده بسياق حول المحادثة؟

نعم. يستخدم النموذج تنسيق رسائل بنمط الدردشة، لذا يمكنك تمرير الأجزاء السابقة قبل الصوت. يستخدم النموذج هذه الأجزاء لتفضيل المفردات التي تناسب الموضوع، مما يساعد في التعامل مع المصطلحات المتخصصة.

هل يعيد طوابع زمنية؟

نعم. تصف Alibaba الطوابع الزمنية على مستوى الكلمات وحدود الجمل في الاستجابة، بحيث يمكنك مواءمة النص مع الصوت للترجمة، أو المراجعة، أو البحث دون الحاجة إلى خطوة مواءمة منفصلة.

كم تكلفة Fun-ASR Flash 2026-06-15؟

على TokenLab تكلف Fun-ASR Flash 2026-06-15 $0.000035 لكل ثانية. التفاصيل الكاملة في جدول التسعير أعلاه. تعتمد الأسعار على وحدة الفوترة والمواصفات والاستخدام. قارن بين الشروط المتطابقة في التسعير التفصيلي للنموذج؛ السعر الواحد لا يحدد التكلفة الإجمالية.

ما نقطة النهاية التي يجب أن يستخدمها Fun-ASR Flash 2026-06-15؟

استخدم https://api.tokenlab.sh/v1/audio/transcriptions كافتراضي لـ Fun-ASR Flash 2026-06-15. إذا كانت الصيغة الأصلية للمزود مدعومة فإن API workbench يعرضها أيضاً.

ما العمليات التي يدعمها Fun-ASR Flash 2026-06-15؟

Fun-ASR Flash 2026-06-15 يدعم صوت إلى نص. اختر عملية في API workbench أعلاه لرؤية نقطة النهاية وعينة الكود المطابقة.

مقارنة Fun-ASR Flash 2026-06-15

المصادر

تمت المراجعة في ٠٢‏/١٠‏/٢٠٢٦

المزيد من Fun-ASR

نماذج ذات صلة