Skip to main content
Библиотека

Сега се репродуцира · Бенчмаркови

Ray ASR бенчмарк: 98 јазици, целосни резултати

Концизен преглед на тоа како Sunray и MoonRay се оценуваат преку широк повеќејазичен бенчмарк за препознавање говор.

Ray Team20 МАР. 2026 Г.3 min read

Два механизми, една задача

Ray користи два механизми за препознавање говор бидејќи не сите работни процеси за титлови бараат ист компромис.

Sunray (порано Ray Max) е оптимизиран за точност. Тој е механизмот за јазици со малку ресурси, архивски материјали, професионална работа со титлови и секоја ситуација во која текстот треба да биде што е можно поблизок до изговореното аудио.

MoonRay (порано Ray Turbo) е оптимизиран за брзина. Тој е механизмот за гледање во живо, брзи прегледи и големи серии каде што е важно брзо да се добијат употребливи титлови.

Бенчмаркот зад оваа објава ги споредува двата механизми на 98 јазици, користејќи го истиот процес на оценување за секој модел. Целта не е нејасно тврдење дека Ray е повеќејазичен. Целта е да се обезбеди повторлив начин да се види како механизмите се однесуваат кај многу писма, акценти и јазични семејства.

Забелешка: графиконите подолу се направени пред ребрендирањето на механизмите, па во нивните легенди сè уште се прикажани поранешните имиња — Ray Max сега е Sunray, а Ray Turbo сега е MoonRay.

Како да ги читате бројките

Главната метрика е стапката на грешки во зборови (Word Error Rate), вообичаено скратена како WER. Пониско е подобро. WER од 5 проценти значи дека транскриптот е многу близок до референтниот текст. Висок WER значи дека механизмот направил повеќе замени, вметнувања или бришења.

За полесна споредба, истиот резултат може да се прикаже и како точност:

accuracy = max(0, 100 - WER)

Вториот приказ е полесен за брзо прегледување, но WER останува покорисна инженерска метрика бидејќи точно покажува каде моделот има тешкотии.

Вкупни перформанси

Целосни резултати: сите 98 јазици

Јазици со високи перформанси

Најпредизвикувачки јазици

Што мериме

  • Квалитет на препознавање кај 98 јазици
  • Разликата меѓу Sunray и MoonRay
  • Јазици кај кои точноста е веќе доволно висока за секојдневни титлови
  • Јазици на кои им се потребни повеќе податоци за обука, нормализација или обработка специфична за јазикот
  • Случаи на неуспех во кои моделот вметнува повеќе текст отколку што содржи изворното аудио

Зошто ова е важно за титловите

Механизмот за титлови не се оценува само според тоа колку добро го обработува англискиот јазик. Реалното гледање е посложено: повеќејазични филмови, префрлање меѓу јазици, регионални имиња, снимки со шум и содржини што преминуваат од еден јазик на друг среде сцена.

Ray е создаден за таа реалност. Бенчмарковите ни помагаат да избереме стандардни поставки, да поставиме очекувања и да одлучиме каде треба да се насочи следната работа на обука и оценување.

Важниот резултат за производот е едноставен: Ray може да избира меѓу брзина и точност во зависност од задачата, а двата механизми продолжуваат да се подобруваат додека повеќе јазици минуваат низ процесот на бенчмарк-тестирање.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Најважни резултати од реперните тестови за визуелна безбедност на Ray Guardian
Реперни тестови4 август 2026 г.7 min read

Го претставуваме Ray Guardian: визуелна безбедност за слики и видео

Ray Guardian е обединетиот систем за визуелна безбедност на Ray, реперно тестиран во 13 категории за безбедност на ниво на слика и на видеоподаточни множества со јавни ознаки.

Прочитај ја статијата
Ray JournalБенчмаркови2026-03-20

Ray ASR бенчмарк: 98 јазици, целосни резултати

Концизен преглед на тоа како Sunray и MoonRay се оценуваат преку широк повеќејазичен бенчмарк за препознавање говор.

Ray Team2026-03-203 min read

Два механизми, една задача

Ray користи два механизми за препознавање говор бидејќи не сите работни процеси за титлови бараат ист компромис.

Sunray (порано Ray Max) е оптимизиран за точност. Тој е механизмот за јазици со малку ресурси, архивски материјали, професионална работа со титлови и секоја ситуација во која текстот треба да биде што е можно поблизок до изговореното аудио.

MoonRay (порано Ray Turbo) е оптимизиран за брзина. Тој е механизмот за гледање во живо, брзи прегледи и големи серии каде што е важно брзо да се добијат употребливи титлови.

Бенчмаркот зад оваа објава ги споредува двата механизми на 98 јазици, користејќи го истиот процес на оценување за секој модел. Целта не е нејасно тврдење дека Ray е повеќејазичен. Целта е да се обезбеди повторлив начин да се види како механизмите се однесуваат кај многу писма, акценти и јазични семејства.

Забелешка: графиконите подолу се направени пред ребрендирањето на механизмите, па во нивните легенди сè уште се прикажани поранешните имиња — Ray Max сега е Sunray, а Ray Turbo сега е MoonRay.

Како да ги читате бројките

Главната метрика е стапката на грешки во зборови (Word Error Rate), вообичаено скратена како WER. Пониско е подобро. WER од 5 проценти значи дека транскриптот е многу близок до референтниот текст. Висок WER значи дека механизмот направил повеќе замени, вметнувања или бришења.

За полесна споредба, истиот резултат може да се прикаже и како точност:

accuracy = max(0, 100 - WER)

Вториот приказ е полесен за брзо прегледување, но WER останува покорисна инженерска метрика бидејќи точно покажува каде моделот има тешкотии.

Вкупни перформанси

Целосни резултати: сите 98 јазици

Јазици со високи перформанси

Најпредизвикувачки јазици

Што мериме

  • Квалитет на препознавање кај 98 јазици
  • Разликата меѓу Sunray и MoonRay
  • Јазици кај кои точноста е веќе доволно висока за секојдневни титлови
  • Јазици на кои им се потребни повеќе податоци за обука, нормализација или обработка специфична за јазикот
  • Случаи на неуспех во кои моделот вметнува повеќе текст отколку што содржи изворното аудио

Зошто ова е важно за титловите

Механизмот за титлови не се оценува само според тоа колку добро го обработува англискиот јазик. Реалното гледање е посложено: повеќејазични филмови, префрлање меѓу јазици, регионални имиња, снимки со шум и содржини што преминуваат од еден јазик на друг среде сцена.

Ray е создаден за таа реалност. Бенчмарковите ни помагаат да избереме стандардни поставки, да поставиме очекувања и да одлучиме каде треба да се насочи следната работа на обука и оценување.

Важниот резултат за производот е едноставен: Ray може да избира меѓу брзина и точност во зависност од задачата, а двата механизми продолжуваат да се подобруваат додека повеќе јазици минуваат низ процесот на бенчмарк-тестирање.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Продолжи со читање

Го претставуваме Ray Guardian: визуелна безбедност за слики и видео7 min readЗошто секој титл што го преземате е ризик - и како Ray го решава тоа2 min readRay ЧПП: Сè што треба да знаете2 min read