Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

«Речетекст» опубликовал открытую методику замера точности распознавания русской речи

Дата публикации: 31-08-2026 04:30:00

«Речетекст», российский сервис расшифровки аудио- и видеозаписей, опубликовал открытую методику замера точности...

Основное содержимое страницы с новостью.

31 Августа 2026 07:30 31 Авг 2026 07:30 |

«Речетекст» опубликовал открытую методику замера точности распознавания русской речи

«Речетекст», российский сервис расшифровки аудио- и видеозаписей, опубликовал открытую методику замера точности распознавания русской речи. Вместе с результатами выложены скрипты, правила нормализации и контрольные суммы наборов данных. Об этом CNews сообщили представители «Речетекст».

Ключевой вывод замера: точность зависит от материала сильнее, чем от системы. Разброс между чистой начиткой и записью с бытового устройства — более чем вдвое, и любое усреднение по срезам этот разброс скрывает.

«Любой сервис распознавания может написать на главной "точность 97%", и проверить это нельзя: цифра ничего не значит, пока не сказано, на каких записях она получена и по каким правилам считалась. Мы решили, что проще выложить методику целиком — со скриптами и контрольными суммами, чтобы наши цифры мог перепроверить любой, включая тех, кто нам не верит», — сказал Александр Привалов, основатель сервиса «Речетекст».

Что опубликовано: результаты по срезам речи, а не одно число: 6,71% ошибок в словах на подготовленной начитке, 7,62% на спонтанной речи, 12,81% на записях с бытовых устройств в шуме; 2398 записей, 3,1 часа аудио, три открытых набора данных; скрипты, нормализатор текста и контрольные суммы файлов; результаты.

«Речетекст» переводит аудио- и видеозаписи в текст на русском языке — реплики разделяются по говорящим, участники подписываются именами, у каждого слова проставлено время. Серверы в России, есть доступ по HTTP из внешнего кода.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1«Речетекст» опубликовал открытую методику замера точности распознавания русской речи05.131-08-2026
2Группа «Т-Технологии» выложила в открытый доступ потоковую модель распознавания речи на русском языке0522-07-2025
3«Руконтекст» автоматизировал проверку библиографии и выявление сгенерированных нейросетями ссылок09.0327-08-2026
4«Руконтекст» автоматизировал проверку библиографии и выявление сгенерированных нейросетями ссылок09.0327-08-2026
5«Руконтекст» автоматизировал проверку библиографии и выявление сгенерированных нейросетями ссылок09.0327-08-2026
6Сервисы «Яндекса» научились понимать якутскую речь0508-07-2026
7Исследователи из T-Bank AI Research разработали метод универсальной интерпретации моделей без потери точности5711-11-2025
8В России впервые запустили облачный сервис распознавания лиц0001-11-2019
9Российские ученые создали инструмент для проверки данных перед обучением ИИ-моделей013.4513-08-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 5.1. Источник: bigdata.cnews.ru.