قيد التشغيل الآن · معايير الأداء
معيار أداء Ray للتعرّف التلقائي على الكلام (ASR): 98 لغة، والنتائج الكاملة
نظرة موجزة على كيفية تقييم Sunray وMoonRay ضمن معيار أداء واسع النطاق للتعرّف على الكلام متعدد اللغات.
محرّكان، ومهمة واحدة
يستخدم Ray محرّكين للتعرّف على الكلام لأن مسارات عمل الترجمة النصية لا تتطلب جميعها الموازنة نفسها بين السرعة والدقة.
Sunray (المعروف سابقًا باسم Ray Max) مضبوط لتحقيق الدقة. وهو المحرّك المناسب للغات ذات الموارد المحدودة، والمواد الأرشيفية، وأعمال الترجمة النصية الاحترافية، وكل حالة يجب أن يكون فيها النص مطابقًا قدر الإمكان للصوت المنطوق.
MoonRay (المعروف سابقًا باسم Ray Turbo) مضبوط لتحقيق السرعة. وهو المحرّك المناسب للمشاهدة المباشرة، والمعاينات السريعة، والدفعات الكبيرة التي تتطلب الحصول بسرعة على ترجمة نصية قابلة للاستخدام.
يقارن معيار الأداء الذي يستند إليه هذا المنشور بين المحرّكين عبر 98 لغة، باستخدام عملية التقييم نفسها لكل نموذج. والهدف ليس إطلاق ادعاء مبهم بأن Ray متعدد اللغات، بل توفير طريقة قابلة للتكرار لمعرفة كيفية أداء المحرّكين عبر العديد من أنظمة الكتابة واللهجات والعائلات اللغوية.
ملاحظة: تسبق المخططات أدناه إعادة تسمية المحرّكين، لذلك لا تزال مفاتيحها تعرض الاسمين السابقين — أصبح Ray Max الآن Sunray، وأصبح Ray Turbo الآن MoonRay.
كيفية قراءة الأرقام
المقياس الرئيسي هو معدل خطأ الكلمات (Word Error Rate)، ويُختصر عادةً إلى WER. وكلما انخفض كان ذلك أفضل. يعني بلوغ WER نسبة 5 بالمئة أن النص المنسوخ قريب جدًا من النص المرجعي. ويعني ارتفاع WER أن المحرّك أجرى مزيدًا من عمليات الاستبدال أو الإدراج أو الحذف.
ولتسهيل المقارنة، يمكن أيضًا عرض النتيجة نفسها على هيئة دقة:
accuracy = max(0, 100 - WER)يسهل استعراض هذا العرض الثاني، لكن WER يظل المقياس الهندسي الأكثر فائدة لأنه يوضح بدقة مواضع تعثّر النموذج.
الأداء الإجمالي
النتائج الكاملة: جميع اللغات الـ98
اللغات عالية الأداء
اللغات الأكثر تحديًا
ما نقيسه
- جودة التعرّف عبر 98 لغة
- الفرق بين Sunray وMoonRay
- اللغات التي أصبحت دقتها قوية بما يكفي للترجمة النصية اليومية
- اللغات التي تحتاج إلى مزيد من بيانات التدريب أو التطبيع أو المعالجة الخاصة باللغة
- حالات الإخفاق التي يُدرج فيها النموذج نصًا أكثر مما يحتوي عليه الصوت المصدر
أهمية ذلك للترجمة النصية
لا يُحكم على محرّك الترجمة النصية بناءً على مدى إجادته التعامل مع الإنجليزية فحسب. فالمشاهدة الفعلية أكثر تعقيدًا، وتشمل أفلامًا متعددة اللغات، والتناوب بين اللغات، والأسماء الإقليمية، والتسجيلات المشوشة، والمحتوى الذي ينتقل بين اللغات في منتصف المشهد.
صُمم Ray لهذا الواقع. وتساعدنا معايير الأداء على اختيار الإعدادات الافتراضية، ووضع التوقعات، وتحديد وجهة العمل التالي في التدريب والتقييم.
والنتيجة المهمة للمنتج بسيطة: يستطيع Ray الاختيار بين السرعة والدقة وفقًا للمهمة، ويواصل كلا المحرّكين التحسن مع مرور مزيد من اللغات عبر مسار عمل معيار الأداء.

