Длинные записи Распознавание
Новости сервиса

Многочасовые записи: текст появляется по мере обработки

Из истории Speech Expert

Добавлен режим потокового распознавания длинного файла из браузера. Он предназначен для многочасовых записей, которые неудобно обрабатывать как обычную загрузку: файл передаётся частями, а расшифровка появляется постепенно.

Результат до окончания всей записи

В первом варианте режима доступно потоковое распознавание русской речи. Интерфейс показывает предварительный текст и завершённые фрагменты с временными отметками, а также прогресс обработки. Перед запуском не требуется целиком декодировать большой исходник в памяти браузера.

Учёт использования также идёт по мере распознавания. Кредиты списываются за фактически обработанный звук, а при остановке уже полученные окончательные фрагменты остаются у клиента. Это помогает контролировать длительную задачу, не дожидаясь её полного окончания.

Отдельный сценарий для длинных файлов

Первая версия работает в открытой вкладке и сводит звук в один канал. Она рассчитана на последовательное получение текста; расширенные функции вроде разделения участников и формирования резюме в этот режим не входят. Для разработчиков также добавлен инструмент распознавания файлов по gRPC с возможностью продолжить прерванную обработку.