Skip to main content
Медиатека

Сейчас воспроизводится · Бенчмарки

Бенчмарк ASR Ray: 98 языков, полные результаты

Краткий обзор того, как Sunray и MoonRay оцениваются в рамках масштабного многоязычного бенчмарка распознавания речи.

Ray Team20 МАР. 2026 Г.3 min read

Два движка, одна задача

Ray использует два движка распознавания речи, поскольку для разных сценариев работы с субтитрами нужен разный баланс характеристик.

Sunray (ранее Ray Max) оптимизирован для точности. Этот движок предназначен для языков с ограниченным количеством ресурсов, архивных материалов, профессиональной работы с субтитрами и любых ситуаций, когда текст должен быть максимально близок к звучащей речи.

MoonRay (ранее Ray Turbo) оптимизирован для скорости. Этот движок предназначен для просмотра в реальном времени, быстрого предварительного просмотра и обработки больших пакетов, когда важно оперативно получить пригодные для использования субтитры.

Бенчмарк, лежащий в основе этой публикации, сравнивает оба движка на 98 языках, используя одинаковый процесс оценки для каждой модели. Цель не в расплывчатом заявлении о том, что Ray поддерживает множество языков. Цель — создать воспроизводимый способ увидеть, как движки работают с разными системами письма, акцентами и языковыми семьями.

Примечание: приведённые ниже диаграммы были созданы до переименования движков, поэтому в их легендах всё ещё указаны прежние названия — Ray Max теперь называется Sunray, а Ray Turbo — MoonRay.

Как читать показатели

Основная метрика — Word Error Rate (частота ошибок в словах), обычно сокращаемая до WER. Чем ниже значение, тем лучше. WER в 5 процентов означает, что транскрипция очень близка к эталонному тексту. Высокий WER означает, что движок допустил больше замен, вставок или удалений.

Для более удобного сравнения тот же результат можно также представить в виде точности:

accuracy = max(0, 100 - WER)

Второй вариант легче воспринимать беглым взглядом, но WER остаётся более полезной инженерной метрикой, поскольку точно показывает, где у модели возникают трудности.

Общая производительность

Полные результаты: все 98 языков

Языки с высокими результатами

Наиболее сложные языки

Что мы измеряем

  • Качество распознавания на 98 языках
  • Разницу между Sunray и MoonRay
  • Языки, для которых точность уже достаточно высока для повседневного использования субтитров
  • Языки, которым требуется больше обучающих данных, нормализация или специализированная обработка
  • Случаи сбоев, когда модель вставляет больше текста, чем содержится в исходной аудиодорожке

Почему это важно для субтитров

Движок субтитров оценивают не только по тому, насколько хорошо он справляется с английским языком. Реальные условия просмотра сложнее: многоязычные фильмы, переключение между языками, региональные имена, записи с шумом и контент, в котором язык меняется прямо посреди сцены.

Ray создан для этой реальности. Бенчмарки помогают нам выбирать настройки по умолчанию, формировать ожидания и определять направления дальнейшего обучения и оценки.

Главный результат для продукта прост: Ray может выбирать между скоростью и точностью в зависимости от задачи, а оба движка продолжают совершенствоваться по мере того, как всё больше языков проходит через конвейер бенчмарка.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Ключевые результаты бенчмарков визуальной безопасности Ray Guardian
Бенчмарки4 августа 2026 г.6 min read

Представляем Ray Guardian: визуальная безопасность изображений и видео

Ray Guardian — единая система визуальной безопасности Ray, протестированная по 13 категориям безопасности на уровне изображений и видеодатасетах с общедоступной разметкой.

Читать материал
Ray JournalБенчмарки2026-03-20

Бенчмарк ASR Ray: 98 языков, полные результаты

Краткий обзор того, как Sunray и MoonRay оцениваются в рамках масштабного многоязычного бенчмарка распознавания речи.

Ray Team2026-03-203 min read

Два движка, одна задача

Ray использует два движка распознавания речи, поскольку для разных сценариев работы с субтитрами нужен разный баланс характеристик.

Sunray (ранее Ray Max) оптимизирован для точности. Этот движок предназначен для языков с ограниченным количеством ресурсов, архивных материалов, профессиональной работы с субтитрами и любых ситуаций, когда текст должен быть максимально близок к звучащей речи.

MoonRay (ранее Ray Turbo) оптимизирован для скорости. Этот движок предназначен для просмотра в реальном времени, быстрого предварительного просмотра и обработки больших пакетов, когда важно оперативно получить пригодные для использования субтитры.

Бенчмарк, лежащий в основе этой публикации, сравнивает оба движка на 98 языках, используя одинаковый процесс оценки для каждой модели. Цель не в расплывчатом заявлении о том, что Ray поддерживает множество языков. Цель — создать воспроизводимый способ увидеть, как движки работают с разными системами письма, акцентами и языковыми семьями.

Примечание: приведённые ниже диаграммы были созданы до переименования движков, поэтому в их легендах всё ещё указаны прежние названия — Ray Max теперь называется Sunray, а Ray Turbo — MoonRay.

Как читать показатели

Основная метрика — Word Error Rate (частота ошибок в словах), обычно сокращаемая до WER. Чем ниже значение, тем лучше. WER в 5 процентов означает, что транскрипция очень близка к эталонному тексту. Высокий WER означает, что движок допустил больше замен, вставок или удалений.

Для более удобного сравнения тот же результат можно также представить в виде точности:

accuracy = max(0, 100 - WER)

Второй вариант легче воспринимать беглым взглядом, но WER остаётся более полезной инженерной метрикой, поскольку точно показывает, где у модели возникают трудности.

Общая производительность

Полные результаты: все 98 языков

Языки с высокими результатами

Наиболее сложные языки

Что мы измеряем

  • Качество распознавания на 98 языках
  • Разницу между Sunray и MoonRay
  • Языки, для которых точность уже достаточно высока для повседневного использования субтитров
  • Языки, которым требуется больше обучающих данных, нормализация или специализированная обработка
  • Случаи сбоев, когда модель вставляет больше текста, чем содержится в исходной аудиодорожке

Почему это важно для субтитров

Движок субтитров оценивают не только по тому, насколько хорошо он справляется с английским языком. Реальные условия просмотра сложнее: многоязычные фильмы, переключение между языками, региональные имена, записи с шумом и контент, в котором язык меняется прямо посреди сцены.

Ray создан для этой реальности. Бенчмарки помогают нам выбирать настройки по умолчанию, формировать ожидания и определять направления дальнейшего обучения и оценки.

Главный результат для продукта прост: Ray может выбирать между скоростью и точностью в зависимости от задачи, а оба движка продолжают совершенствоваться по мере того, как всё больше языков проходит через конвейер бенчмарка.

Subscribe to the Ray newsletter. Product updates, release notes, and customer news.

No spam. Just the Ray newsletter and important product updates.

Читать дальше

Представляем Ray Guardian: визуальная безопасность изображений и видео6 min readПочему каждые скачанные субтитры — это лотерея и как Ray решает эту проблему2 min readЧасто задаваемые вопросы о Ray: всё, что вам нужно знать2 min read