Распознавание Длинные записи 4 языка
Новости сервиса

Длинные записи на четырёх языках — прямо в браузере

Из истории Speech Expert

Режим «Длинный файл · потоково» в браузере расширен на русский, английский, казахский и узбекский языки. Можно передавать исходную запись частями и читать текст завершённых фраз, пока остальное аудио ещё обрабатывается.

Большой файл без предварительной нарезки

Режим принимает файл размером до 10 ГиБ. В интерфейсе отдельно показаны прогресс загрузки и длительность обработанного аудио: завершение передачи файла не означает, что распознавание уже закончено. Язык задаётся для всей записи, а совместимый режим обработки выбирается автоматически.

Для русского доступно дополнительное уточнение окончательных фраз. Английский, казахский и узбекский возвращают окончательный текст непосредственно из потока. Каналы исходного файла сводятся в mono; разделение по спикерам и LLM-коррекция в этом режиме недоступны. Для казахского и узбекского возвращаются границы фрагментов без пословных таймкодов.

Вкладку нужно оставить открытой

Это обработка с активным соединением: закрытие вкладки или разрыв связи останавливает сеанс, автоматического продолжения с места обрыва нет. Дождитесь сообщения о завершении и сохраняйте полученный текст. Списание рассчитывается по длительности обработанного аудио, в том числе если сеанс остановлен раньше конца файла.

Как распознавать длинные записи